NVIDIA Nemotron 3 Super Oferece 5x Mais Throughput para IA Agentic

Lançado hoje, o NVIDIA Nemotron 3 Super é um modelo aberto de 120 bilhões de parâmetros com 12 bilhões de parâmetros ativos, projetado para executar sistemas complexos de IA agentic em escala. Disponível agora, o modelo combina capacidades avançadas de raciocínio para completar tarefas de forma eficiente com alta precisão para agentes autônomos. Empresas Nativas de IA: A Perplexity oferece a seus usuários acesso ao Nemotron 3 Super para busca e como um dos 20 modelos orquestrados no Computer. Empresas que oferecem agentes de desenvolvimento de software como CodeRabbit, Factory e Greptile estão integrando o modelo em seus agentes de IA, juntamente com modelos proprietários, para alcançar maior precisão a um custo menor. E organizações de ciências da vida e de IA de fronteira como Edison Scientific e Lila Sciences irão alimentar seus agentes para pesquisa profunda de literatura, ciência de dados e compreensão molecular. Plataformas de Software Empresarial: Líderes da indústria como Amdocs, Palantir, Cadence, Dassault Systèmes e Siemens estão implementando e personalizando o modelo para automatizar fluxos de trabalho em telecomunicações, cibersegurança, design de semicondutores e manufatura. À medida que as empresas avançam além dos chatbots para aplicações multiagentes, elas encontram duas restrições. A primeira é a explosão de contexto. Fluxos de trabalho multiagentes geram até 15x mais tokens do que o chat padrão porque cada interação exige o reenvio de históricos completos, incluindo saídas de ferramentas e raciocínio intermediário. Em tarefas longas, esse volume de contexto aumenta os custos e pode levar a um desvio de objetivo, onde os agentes perdem o alinhamento com o objetivo original. A segunda é o imposto sobre o pensamento. Agentes complexos devem raciocinar a cada passo, mas usar grandes modelos para cada subtarefa torna as aplicações multiagentes muito caras e lentas para aplicações práticas. O Nemotron 3 Super possui uma janela de contexto de 1 milhão de tokens, permitindo que os agentes retenham o estado completo do fluxo de trabalho na memória e evitem o desvio de objetivo. O Nemotron 3 Super estabeleceu novos padrões, conquistando o primeiro lugar na Artificial Analysis em eficiência e abertura com precisão líder entre modelos do mesmo tamanho. O modelo também impulsiona o agente de pesquisa NVIDIA AI-Q para a posição número 1 nas tabelas de classificação DeepResearch Bench e DeepResearch Bench II, benchmarks que medem a capacidade de um sistema de IA de conduzir pesquisas exaustivas e em várias etapas em grandes conjuntos de documentos, mantendo a coerência do raciocínio. Arquitetura Híbrida O Nemotron 3 Super usa uma arquitetura de mixture-of-experts (MoE) híbrida que combina três grandes inovações para oferecer até 5x mais throughput e até

Fonte: NVIDIA AI Blog

Publicado em 2026-03-11

Notícias relacionadas

Continue explorando