Como as GPUs NVIDIA Ajudam a Acelerar o GPT-6 Astra Ultrafast da OpenAI

O GPT-6 Astra Ultrafast, rodando em GPUs NVIDIA Blackwell, já está disponível na API da OpenAI e para usuários elegíveis do ChatGPT Work e Codex. Acelerado por otimizações de inferência através dos modelos da OpenAI que aproveitam as capacidades da arquitetura NVIDIA Blackwell, o Ultrafast oferece uma geração de tokens até 8x mais rápida do que o modo Astra Standard. Para desenvolvedores, uma geração mais rápida pode encurtar os ciclos de edição-teste-depuração dos agentes de codificação, reduzir o tempo gasto na geração de respostas entre chamadas de ferramentas e tornar as aplicações interativas mais responsivas. Uma resposta mais rápida é mais importante quando é repetida em um fluxo de trabalho: um agente escreve código, usa uma ferramenta, verifica o resultado e decide o que fazer em seguida. O Ultrafast incorpora as capacidades do Astra nesses ciclos sensíveis ao tempo. A infraestrutura de AI da NVIDIA ajuda a OpenAI a fornecer saídas de modelo mais úteis quando os desenvolvedores precisam. “O profundo investimento da NVIDIA em ferramentas e documentação nos permitiu tornar nossos modelos excepcionalmente bons em programar GPUs Blackwell e Rubin”, disse Philippe Tillet, líder de inferência na OpenAI. “O Astra pode transformar esse conhecimento em kernels de alto desempenho que tornam o hardware da NVIDIA atraente em toda a fronteira de latência, throughput e custo. Com o Astra Ultrafast, isso significa respostas de modelo mais rápidas à medida que os agentes escrevem código, usam ferramentas e trabalham em tarefas complexas.” Desempenho em Constante Melhoria Os ganhos de desempenho não param quando um modelo é implantado. A OpenAI está usando seus próprios modelos para ajudar a refinar o software de inferência que roda nas GPUs NVIDIA, aproveitando a programabilidade da plataforma para testar e implementar melhorias. Esse trabalho contínuo pode tornar as respostas do modelo mais rápidas e a infraestrutura implantada mais produtiva ao longo do tempo. “Nosso trabalho com a NVIDIA está nos ajudando a tornar a AI mais rápida e útil”, disse Uday Ruddarraju, diretor de tecnologia de computação da OpenAI. “Usamos nossos modelos internos para otimizar a inferência em GPUs NVIDIA, e a programabilidade da NVIDIA nos ajudou a entregar a aceleração por trás do Astr

Fonte: NVIDIA AI Blog

Publicado em 2026-10-01

Notícias relacionadas

Continue explorando