Para gerar inteligência em escala, as fábricas de IA funcionam continuamente, e sua economia é definida pela produção entregue: tokens por segundo, tokens por watt, custo por token, utilização e tempo de atividade. Isso exige uma infraestrutura de IA projetada e construída como uma fábrica completa, não uma coleção de aceleradores individuais. Hyperscalers e empresas nativas de IA que constroem XPUs personalizadas devem considerar não apenas o design da XPU, mas também o design e desenvolvimento de toda a plataforma de IA, incluindo redes scale-up e scale-out, arquitetura em nível de rack, software de fábrica de produção e um ecossistema de fornecedores robusto. Em escala de fábrica de IA, esse caminho é complexo e custoso, e representa um obstáculo fundamental para levar as XPUs ao mercado rapidamente. Quebrar essa restrição significa combinar XPUs personalizadas com infraestrutura comprovada e madura — permitindo que os construtores foquem a inovação onde ela é mais importante, enquanto aproveitam a tecnologia estabelecida para o resto. O NVLink Fusion atende a essa necessidade, conectando XPUs à infraestrutura de IA líder mundial da NVIDIA para aumentar o desempenho, acelerar o tempo de lançamento no mercado e mitigar riscos para fábricas de IA semipersonalizadas. Desbloqueie o Desempenho da XPU com Scale-Up Rápido Para cargas de trabalho modernas, como a execução de modelos com trilhões de parâmetros, arquiteturas mixture-of-experts e IA agêntica, se a malha de scale-up…
Fonte: NVIDIA AI Blog
Publicado em 2026-08-24