A lacuna entre modelos proprietários de ponta e modelos open-source altamente transparentes está diminuindo mais rápido do que nunca. A NVIDIA revelou oficialmente o Nemotron 3 Super, um impressionante modelo de raciocínio de 120 bilhões de parâmetros projetado especificamente para aplicações multiagente complexas. Lançado hoje, o Nemotron 3 Super se posiciona perfeitamente entre o leve Nemotron 3 Nano de 30 bilhões de parâmetros e o altamente antecipado Nemotron 3 Ultra de 500 bilhões de parâmetros, que chegará no final de 2026. Oferecendo até 7x mais vazão e o dobro da precisão da sua geração anterior, este modelo é um salto gigantesco para desenvolvedores que se recusam a comprometer entre inteligência e eficiência de inferência. Os 'Cinco Milagres' do Nemotron 3 Super O desempenho sem precedentes do Nemotron 3 Super é impulsionado por cinco grandes avanços tecnológicos: Arquitetura MoE Híbrida: O modelo combina inteligentemente camadas Mamba eficientes em termos de memória com camadas Transformer de alta precisão. Ao ativar apenas uma fração dos parâmetros para gerar cada token, ele alcança um aumento de 4x na eficiência de uso do cache KV e SSM. Previsão de Múltiplos Tokens (MTP): O modelo pode prever múltiplos tokens futuros simultaneamente, resultando em tempos de inferência 3x mais rápidos em tarefas de raciocínio complexas. Janela de Contexto de 1 Milhão: Apresentando um comprimento de contexto 7x maior do que a geração anterior, os desenvolvedores podem inserir relatórios técnicos massivos ou bases de código inteiras diretamente na memória do modelo, eliminando a necessidade de re-raciocínio em fluxos de trabalho de várias etapas. MoE Latente: Isso permite que o modelo comprima informações e ative quatro especialistas pelo mesmo custo computacional de um. Sem esta inovação, o modelo precisaria ser 35 vezes maior para alcançar os mesmos níveis de precisão. Integração com NeMo RL Gym: Através de pipelines interativos de aprendizado por reforço, o modelo aprende a partir de loops de feedback dinâmicos em vez de apenas texto estático, dobrando efetivamente seu índice de inteligência. Todos esses avanços levam a uma eficiência incrível em termos de tokens de saída por GPU. Por que o Nemotron 3 Super é o Motor Definitivo para a IA Multiagente? O Nemotron 3 Super não é apenas um modelo de linguagem grande padrão; ele é especificamente posicionado como um motor de raciocínio projetado para planejar, verificar e executar tarefas complexas dentro de um sistema mais amplo de modelos especializados. Aqui está o porquê de sua arquitetura o tornar um divisor de águas para fluxos de trabalho multiagente: Alta Vazão para Raciocínio Mais Profundo: A vazão 7x maior do modelo fisicamente
Fonte: MarkTechPost
Publicado em 2026-03-11