Com base em quase uma década de coengenharia, a CoreWeave incorporou computação, rede e software NVIDIA em uma nuvem construída propositalmente para AI que ainda gera retorno sobre o investimento em múltiplas gerações de implantação. Agora, a CoreWeave está levando a próxima geração de infraestrutura NVIDIA para produção. No CoreWeave Fully Connected, evento que acontece esta semana em São Francisco, a CoreWeave anunciou a disponibilidade dos sistemas NVIDIA Vera Rubin NVL72 com rede Ethernet Spectrum-X 102.4T. A Cognition, o laboratório de AI aplicada por trás do engenheiro de software Devin AI, é o primeiro cliente a executar cargas de trabalho de produção no Vera Rubin. A CoreWeave também oferecerá o NVIDIA Vera, o primeiro CPU construído para agentes de AI. Além disso, a CoreWeave lançou o CoreWeave Forge, um ambiente conectado para treinar, avaliar e melhorar modelos e agentes em computação acelerada NVIDIA. “A computação acelerada NVIDIA oferece valor em diversas gerações”, disse Ian Buck, vice-presidente de hiperescala e computação de alto desempenho da NVIDIA. “As GPUs NVIDIA V100 da CoreWeave ainda estão executando cargas de trabalho de clientes quase uma década após o lançamento da Volta, mesmo enquanto a CoreWeave traz o Vera Rubin NVL72 para produção. Essa é a força da plataforma NVIDIA: infraestrutura que continua a render por anos, e a flexibilidade de colocar a GPU certa na carga de trabalho certa.” A Cognition roda no Vera Rubin NVL72 com 4.8x Mais Throughput de Tokens. A Cognition executa treinamento, aprendizado por reforço e inferência de produção para Devin na CoreWeave. A empresa escalou para milhares de GPUs na CoreWeave em nove meses, impulsionando as cargas de trabalho de inferência da Cognition. No início deste mês, a CoreWeave recebeu seus primeiros racks de produção Vera Rubin NVL72. Pouco depois, a Cognition fez um benchmark do desempenho de inferência do Vera Rubin contra uma linha de base GB200 NVL72 usando uma carga de trabalho de engenharia de software do mundo real. Para gerar esta carga de trabalho, ela amostrou um subconjunto de tarefas do FrontierCode e implementou agentes de AI para resolvê-las. Em seus primeiros testes, a Cognition viu o Vera Rubin N
Fonte: NVIDIA AI Blog
Publicado em 2026-09-30