Faíscas Voam: NVIDIA Acelera a IA Local na IFA 2026

A inteligência de fronteira está se tornando local. Na IFA 2026, a NVIDIA, a Microsoft e seus parceiros estão se unindo para fornecer inferência mais rápida e novas ferramentas que facilitam a configuração e execução de agentes localmente em hardware NVIDIA. Novos PCs compactos NVIDIA RTX Spark Windows também chegarão em outubro para dar aos entusiastas de AI, desenvolvedores e criadores mais maneiras de executar agentes capazes localmente e com segurança. Os anúncios de hoje incluem: Suporte simplificado de AI local para GPUs NVIDIA está chegando ao Hermes Agent, OpenClaw e Perplexity Portable Computer. Inferência local até 1,9x mais rápida — novas otimizações llama.cpp e vLLM já estão disponíveis diretamente e através do LM Studio e Ollama. NVIDIA PAIR — uma ferramenta Personal AI Router que distribui inteligentemente a inferência de AI pelos PCs na rede local de um usuário. NVIDIA RTX Spark chega em outubro — com novos PCs Windows da Lenovo e Acer. Electronic Arts, Embark e Ubisoft estão entre os mais recentes editores e desenvolvedores de jogos que trazem seus títulos de sucesso para o NVIDIA RTX Spark. Além disso, agosto foi um mês agitado para a AI local: Nemotron 3.5 Lightning — que pode ser executado em PCs NVIDIA RTX, Workstations RTX PRO, DGX Spark e Jetson — é um modelo de 30 bilhões de parâmetros que foi lançado. Comece a usar o Nemotron 3.5 Lightning hoje. O GLM-5.3-Flash da Z.ai é um modelo multimodal mixture-of-experts (MoE) que está trazendo AI agêntica para a DGX Station. A Qwen lançou o Qwen3.8-Flash-Next, um modelo MoE multimodal de peso aberto, que pode ser executado localmente no DGX Spark e DGX Station, juntamente com o Qwen3.8-27B, um modelo aberto de 27 bilhões de parâmetros otimizado para cargas de trabalho agênticas e de codificação locais em GPUs NVIDIA. O LTX 2.5 da LTX é um modelo de geração de vídeo de mundo aberto otimizado para GPUs NVIDIA RTX, DGX Spark e DGX Station, com novos aprimoramentos NVFP4, FastVideo e ComfyUI para geração local mais rápida e com uso mais eficiente de memória. O MiniMax-H3 é um modelo de geração de vídeo de peso aberto com áudio sincronizado que pode ser executado localmente em GPUs NVIDIA através do ComfyUI. A FastVideo se juntou a

Fonte: NVIDIA AI Blog

Publicado em 2026-09-03

Notícias relacionadas

Continue explorando