À medida que a IA migra de chatbots para agentes autônomos, modelos abertos estão atendendo às demandas do mercado por controle total sobre onde a IA é executada e como é implantada e evolui. Hoje, a NVIDIA está expandindo sua família de modelos Nemotron 3 com o Nemotron 3.5 Lightning, o modelo de maior eficiência em sua classe para cargas de trabalho de IA agente de longa duração. Este lançamento segue o Nemotron 3 Nano e reflete o compromisso da NVIDIA em melhorar continuamente os modelos abertos para maior precisão e velocidade. Construído para tarefas especializadas dentro de sistemas multiagentes maiores, o Nemotron 3.5 Lightning, um modelo Mixture-of-Experts com 30 bilhões de parâmetros, ajuda a criar aplicações de agentes mais inteligentes e eficientes. Além disso, a NVIDIA está lançando o NeMo Switchyard, uma biblioteca de código aberto para roteamento inteligente dentro de ferramentas de agentes populares. As empresas podem usá-lo para construir um roteador baseado em suas necessidades específicas. Quando implantado, o NeMo Switchyard pode direcionar inteligentemente cada solicitação para o modelo mais capaz e adequado para o trabalho, através da própria combinação de modelos abertos, proprietários e NVIDIA dos desenvolvedores, sem exigir que os desenvolvedores reescrevam suas aplicações. Juntos, o Nemotron 3.5 Lightning e o NeMo Switchyard proporcionam maior controle sobre como a IA é implantada, onde é executada e quão eficientemente opera — em PCs, estações de trabalho, data centers e na nuvem. O Nemotron 3.5 Lightning oferece inteligência de ponta em um modelo aberto pequeno e personalizável, construído para fluxos de trabalho de agentes de alto volume. Agentes Sempre Ativos Precisam de um Sistema de Modelos Os sistemas de agentes modernos — agentes sempre ativos — operam cada vez mais como sistemas de modelos, ou conjuntos de modelos, com diferentes modelos especializados para diferentes tarefas. Os modelos abertos NVIDIA Nemotron são projetados para essa arquitetura. Um modelo de raciocínio de fronteira, como o Nemotron 3 Ultra ou GPT-5.6, pode planejar e orquestrar um fluxo de trabalho, enquanto modelos especializados menores, como o Nemotron 3.5 Lightning, podem executar tarefas direcionadas, como revisão de código, uso de ferramentas, monitoramento de alertas de segurança e resposta a perguntas de faturamento. Capacitando Alto Volume
Fonte: NVIDIA AI Blog
Publicado em 2026-08-11