NVIDIA e AWS Colaboram para Levar a IA à Produção em Escala

Construir sistemas de IA em escala é exigente, requerendo inferência de baixa latência, busca vetorial rápida, forte desempenho de preço de GPU e infraestrutura que possa crescer sem multiplicar a complexidade operacional. O trabalho mais recente da NVIDIA com a Amazon Web Services (AWS) aborda cada uma dessas restrições. Através do Amazon OpenSearch e Amazon EC2, a infraestrutura de IA da NVIDIA está oferecendo às empresas caminhos mais práticos para implantar IA em escala de produção. As instâncias EC2 G7, alimentadas pelas GPUs NVIDIA RTX PRO 4500 Blackwell Server Edition, expandem a camada de computação para workloads de IA, gráficos, vídeo e análise de dados, enquanto a biblioteca NVIDIA cuVS acelera a camada de recuperação, tornando a indexação vetorial alimentada por GPU o padrão no OpenSearch Serverless. E com a AWS alcançando o status de NVIDIA Exemplar Cloud para NVIDIA GB300, os clientes podem ter certeza de que estão recebendo o desempenho máximo otimizado para seus workloads de treinamento. GPUs NVIDIA RTX PRO 4500 Blackwell Server Edition Multi-Workload Alimentam Novas Instâncias Amazon EC2 G7. As instâncias Amazon EC2 G7 trazem as GPUs NVIDIA RTX PRO 4500 Blackwell Server Edition para a AWS para inferência de IA, gráficos, computação espacial e análise de dados acelerada por GPU — entregando um novo tipo de instância projetado para workloads de produção que precisam de desempenho sem a sobrecarga operacional de uma plataforma de GPU gerenciada pelo cliente. Comparado com as instâncias G6, o G7 oferece até 4,6x de desempenho de inferência de IA, até 2,1x de desempenho gráfico e análise de dados significativamente mais rápida acelerada por GPU no Amazon EMR usando a biblioteca NVIDIA cuDF para workloads Apache Spark. Com suporte para até oito GPUs, 256 GB de memória total de GPU, 700 Gbps de rede habilitada para EFA e até 7,6 TB de armazenamento NVMe SSD local — em configurações de uma, duas, quatro e oito GPUs, além de bare metal, em breve — as instâncias G7 permitem que os clientes ajustem a infraestrutura para seus workloads em vez de superprovê-las. A versatilidade da plataforma significa que as equipes de IA obtêm inferência de menor latência. Equipes de mídia e entretenimento obtêm

Fonte: NVIDIA AI Blog

Publicado em 2026-06-24

Notícias relacionadas

Continue explorando