Nvidia e Amazon anunciam expansão de capacidade: AWS implantará 2 milhões de GPUs adicionais em 2027-2028

📅 2026-08-27

Resumo:

Em 26 de agosto, horário local de Seattle e Santa Clara, Califórnia, a Amazon Cloud Technology (AWS) e a NVIDIA divulgaram simultaneamente uma declaração estratégica de expansão da cooperação: A AWS planeja implantar mais 2 milhões de processadores gráficos NVIDIA em sua infraestrutura global de 2027 a 2028, com modelos de chips incluindo Blackwell Ultra, Rubin e Rubin Ultra. As partes não anunciaram o valor do contrato. No mesmo dia, a Nvidia disse em uma teleconferência de resultados que a Amazon usará sua pilha completa de tecnologia de inteligência artificial física para robôs de armazém.

Há cerca de cinco meses, a AWS anunciou na conferência NVIDIA GTC 2026 que adicionaria mais de 1 milhão de GPUs NVIDIA a partir de 2026. As duas empresas disseram desta vez que a demanda para esse nível foi superada. De acordo com o calibre oficial, o novo compromisso é adicionar mais 2 milhões de unidades ao plano original, elevando a escala total de implantação para mais de 3 milhões de unidades. O valor do contrato, preço unitário e ritmo anual de entrega ainda não foram divulgados.


A AWS instalará mais 2 milhões de GPUs de 2027 a 2028

O comunicado de imprensa conjunto afirmou que os 2 milhões de GPUs adicionais serão implantados na infraestrutura global da AWS, cobrindo a chamada “fábrica de inteligência artificial” e instâncias de nuvem voltadas para o cliente. Os usos são listados em diversas categorias: IA inteligente, computação científica, automação empresarial e IA física. O diretor financeiro da Nvidia, Kress, acrescentou na conferência de resultados que um número não revelado de processadores centrais Vera também será fornecido à AWS, com alguns integrados ao Rubin e alguns entregues separadamente.

Ambas as partes escreveram simultaneamente a interconexão de alta velocidade NVLink Fusion da NVIDIA e a memória personalizada de alta largura de banda (NVHBM) no rack Trainium de próxima geração. O site oficial da Amazon afirma que a próxima geração do Trainium foi anunciada na re:Invent em 2025 para oferecer suporte ao NVLink Fusion; desta vez, a memória personalizada da NVIDIA está conectada à mesma arquitetura de rack, para que as GPUs Trainium e NVIDIA possam ser expandidas no mesmo gabinete. A Wccftech citou os materiais da NVIDIA daquele dia dizendo que o NVHBM tem largura de banda cerca de 30% maior e eficiência energética cerca de 15% maior do que o HBM4E. Esses indicadores vêm do calibre do fornecedor e as duas partes não forneceram amostras de controle medidas reais.

A AWS também expandirá a capacidade da Blackwell e fornecerá GPUs RTX PRO 4500 Blackwell Server Edition em instâncias Amazon EC2 G7. De acordo com o comunicado de imprensa, em comparação com a geração anterior G6, o G7 tem um desempenho máximo de inferência de inteligência artificial de cerca de 4,6 vezes e um desempenho gráfico de cerca de 2,1 vezes. A AWS é o primeiro grande fornecedor de nuvem a fornecer esta instância de placa aceleradora.

O fundador e CEO da NVIDIA, Jensen Huang, disse no comunicado: "A NVIDIA e a AWS construíram um dos motores de crescimento na era da inteligência artificial e a demanda está à frente de todas as previsões. Nos últimos 16 anos, trabalhamos juntos para trazer a computação da NVIDIA para a nuvem. Agora a cooperação se expandiu para toda a pilha - GPU, CPU, rede, modelos de código aberto e software". O CEO da AWS, Garman, disse que os clientes precisam ser capazes de escolher as ferramentas e confirmar se todas as camadas podem ser conectadas, então a AWS fez otimizações profundas com a NVIDIA em termos de rede, segurança e implantação.

As duas empresas não explicaram quantas unidades de cada modelo representaram os 2 milhões de unidades, quais data centers serão instalados primeiro e como a energia e a refrigeração serão combinadas. O TechCrunch estima, com base na faixa de preço de um único cartão, que todo o negócio pode chegar a dezenas de bilhões de dólares, mas o artigo original também afirma: Os termos financeiros não foram anunciados por ambas as partes.


Os robôs de armazém estão conectados à pilha completa de inteligência artificial física da NVIDIA

Kress disse na teleconferência que a Amazon usará a pilha completa de tecnologia de inteligência artificial física da Nvidia para alimentar robôs de armazém. O comunicado de imprensa divide a pilha de tecnologia em várias partes: plataforma de computação de ponta Jetson, simulação Omniverse e biblioteca de gêmeos digitais e plataforma de desenvolvimento de robôs de código aberto Isaac. O site oficial da Amazon também afirma que o Departamento de Robótica da Amazon usará as ferramentas acima para simulação, dados sintéticos, otimização de rotas, segurança funcional e verificação "real para simulação", e os cálculos serão executados em instâncias Amazon EC2 aceleradas por GPU. O TechCrunch também lista a plataforma modelo mundial Cosmos.

O comunicado não forneceu o número de robôs conectados, a lista de armazéns online ou o cronograma de transformação. A cooperação no lado do armazenamento e os 2 milhões de GPUs no lado da nuvem são termos paralelos e não estão incluídos no mesmo pedido de compra.

A camada de software é escrita em conjunto. O modelo de código aberto Nemotron da Nvidia continua disponível no Amazon Bedrock e SageMaker. A biblioteca cuDF é usada no Amazon EMR para processamento de dados acelerado por GPU. O comunicado de imprensa afirma que a velocidade de processamento é cerca de 3,7 vezes e o desempenho de custo é cerca de 30% superior ao de uma configuração pura de CPU. Amazon OpenSearch usa GPU para indexação vetorial, e diz-se que a velocidade de indexação é de até cerca de 9 vezes e o custo é de cerca de um quarto. Os múltiplos acima são todos do calibre de teste do fabricante. A camada de segurança conecta a plataforma NVIDIA ao sistema AWS Nitro e ao Elastic Fabric Adapter (EFA).

100.000 GPUs do governo dos EUA estão listadas separadamente

As duas partes planejam construir uma "fábrica de inteligência artificial" para o governo dos EUA, fornecendo 100.000 GPUs na infraestrutura segura da AWS para executar cargas de trabalho de segurança federais e nacionais com um nível de confidencialidade de Nível de Impacto 6 (IL6) e superior. As 100.000 peças são o número listado separadamente no extrato. Não é informado se está incluído nos referidos 2 milhões de peças, nem são anunciados o ano de entrega e o local de construção.

A Amazon também enfatizou que chips de desenvolvimento próprio ainda estão à venda. De acordo com relatos da mídia, o negócio de chips de desenvolvimento próprio da Amazon tem uma receita anual de aproximadamente US$ 25 bilhões e tem um compromisso de aproximadamente US$ 225 bilhões de seu laboratório de inteligência artificial; Trainium se posiciona como uma opção que pode ser usada em conjunto com placas aceleradoras Nvidia. Esta expansão coloca Nvidia GPU, Vera CPU e Trainium na mesma narrativa de rack, e os clientes podem misturá-los, e a proporção específica é escolhida pelo cliente. Os dois partidos não anunciaram o horário de lançamento do gabinete de tecido misto.

A Nvidia anunciou no mesmo dia que sua receita para o segundo trimestre do ano fiscal de 2027 foi de US$ 96,2 bilhões, com receita de data center de US$ 89 bilhões, um aumento anual de 117%; sua orientação de receita para o terceiro trimestre foi de US$ 108 bilhões, mais ou menos 2%. Huang Renxun disse em uma entrevista relacionada ao relatório financeiro que a inteligência artificial entrou na fase de "produção de trabalho útil e rentabilização de tokens", e mais poder de computação significa mais tokens. A declaração de expansão foi divulgada no mesmo dia do relatório financeiro, mas o texto de cooperação em si não converteu os 2 milhões de GPUs em uma contribuição para a receita da Nvidia.

Tags relacionadas

Artigos relacionados

Comentários

0/500
验证码
Sem comentários