Empresas aprofundam a integração em toda a pilha de IA, trazendo CPUs NVIDIA Vera, redes avançadas, modelos abertos Nemotron e tecnologias de IA física para a AWS à medida que a demanda do cliente se acelera.
A Amazon Web Services (AWS), uma empresa da Amazon.com, Inc. (NASDAQ: AMZN), e a NVIDIA (NASDAQ: NVDA) anunciaram hoje uma grande expansão de sua colaboração estratégica para atender à crescente demanda global por infraestrutura de IA, em um momento em que essa demanda continua a se acelerar. Aproveitando a rápida adoção de computação acelerada pela NVIDIA na AWS, as empresas planejam implantar 2 milhões de GPUs NVIDIA adicionais na infraestrutura global da AWS e aprofundar sua colaboração em fábricas de IA, CPUs, redes, modelos abertos, processamento de dados e robótica, oferecendo soluções de IA co-desenvolvidas que permitem aos clientes acelerar o desenvolvimento e a implantação de IA em uma escala sem precedentes.
As cargas de trabalho de IA estão escalando em ritmo acelerado, desde o treinamento e a execução de modelos até o processamento, a indexação e o uso de dados para impulsionar aplicações inteligentes. Os clientes estão migrando de projetos-piloto para produção e escalando cargas de trabalho em IA agente, descoberta científica, automação empresarial e robótica. Eles precisam de uma gama mais ampla de modelos, pipelines de dados mais rápidos e novos recursos para casos de uso emergentes, como IA física. Também precisam ter a certeza de que a infraestrutura subjacente consegue acompanhar sua capacidade de inovação, mantendo o mais alto nível de segurança e confiabilidade para cargas de trabalho de missão crítica.
Para atender a essa crescente demanda de laboratórios de ponta, empresas globais, startups e governos, a AWS e a NVIDIA estão se baseando em 16 anos de inovação conjunta para expandir a capacidade de computação de IA e levar novas soluções desenvolvidas em conjunto aos clientes mais rapidamente. Como parte da colaboração ampliada, as empresas estão trabalhando para:
- Implantar 2 milhões de GPUs NVIDIA adicionais na infraestrutura global da AWS em 2027-2028.
- Leve a infraestrutura baseada em CPUs NVIDIA Vera para a AWS.
- Amplie o NVIDIA NVLink Fusion™ com memória de alta largura de banda NVIDIA (NVHBM) personalizada.
- Construir fábricas de IA para o governo dos EUA, incluindo 100.000 GPUs em infraestrutura segura da AWS para executar cargas de trabalho federais e de segurança nacional.
- Integre a plataforma NVIDIA com o AWS Nitro System e o Elastic Fabric Adapter (EFA) para maior segurança e confiabilidade.
- Continuaremos a oferecer suporte aos modelos abertos NVIDIA Nemotron™ no Amazon Bedrock e no Amazon SageMaker, proporcionando aos clientes mais opções de modelos abertos.
- Acelere o processamento de dados e a indexação vetorial no Amazon EMR e no Amazon OpenSearch com as bibliotecas NVIDIA cuDF e cuVS CUDA-X™ para análises e aplicações de IA mais rápidas e econômicas.
- A Amazon Robotics aprimora ainda mais as cargas de trabalho da robótica por meio da adoção da plataforma de IA física da NVIDIA, acelerando a inovação na automação de armazéns e em robôs de última geração.
“Os clientes querem a liberdade de escolher as melhores ferramentas para suas cargas de trabalho de IA e querem ter a certeza de que tudo funcionará perfeitamente em conjunto”, disse Matt Garman, CEO da AWS. “É por isso que investimos fortemente com a NVIDIA para tornar a AWS o melhor lugar para executar tecnologias de IA da NVIDIA, otimizando o desempenho em toda a nossa infraestrutura, desde redes e segurança até a implantação. Essa colaboração ampliada oferece a laboratórios de ponta, empresas e governos ainda mais maneiras de criar e implantar IA na AWS.”
“A NVIDIA e a AWS construíram um dos maiores motores de crescimento da era da IA, e a demanda está superando todas as previsões”, disse Jensen Huang, fundador e CEO da NVIDIA. “Há 16 anos, escalamos juntos a computação em nuvem da NVIDIA. Agora, estamos expandindo nossa parceria para toda a pilha — GPUs, CPUs, redes, modelos abertos e software — para tornar a IA física e ativa uma realidade em um ritmo e escala sem precedentes, que somente a AWS e a NVIDIA podem oferecer. Essa expansão reflete a demanda dos clientes pela plataforma da NVIDIA na AWS.”
Expansão Massiva da Capacidade de Computação de IA:
A AWS oferece a mais ampla gama de instâncias baseadas em GPUs entre todos os provedores de nuvem para impulsionar um conjunto diversificado de cargas de trabalho de IA e aprendizado de máquina. Na NVIDIA GTC 2026, a AWS anunciou planos para adicionar mais de 1 milhão de GPUs NVIDIA a partir de 2026. Desde então, a demanda superou essas expectativas. A AWS planeja implantar mais 2 milhões de GPUs NVIDIA Blackwell Ultra, Rubin e Rubin Ultra em 2027-2028 em toda a Infraestrutura Global da AWS, incluindo fábricas de IA. Essa capacidade adicional ajudará a impulsionar cargas de trabalho de clientes que variam de IA agente e descoberta científica a automação empresarial e IA física. Além disso, a AWS expandirá a capacidade NVIDIA Blackwell, incluindo GPUs NVIDIA RTX PRO™ 4500 Blackwell Server Edition para instâncias Amazon EC2 G7 . As instâncias G7 oferecem desempenho de inferência de IA 4,6 vezes maior e desempenho gráfico 2,1 vezes maior em comparação com as instâncias G6 da geração anterior. A AWS é a primeira grande provedora de nuvem a oferecer instâncias de computação aceleradas pela RTX PRO 4500. A AWS e a NVIDIA também estão colaborando na rede NVIDIA Spectrum™ para otimizar ainda mais o desempenho da rede para cargas de trabalho de treinamento de IA em larga escala em clusters de GPUs.
Suporte para CPUs NVIDIA Vera na AWS:
A AWS e a NVIDIA estão trabalhando para trazer a infraestrutura baseada em CPUs Vera para a AWS, oferecendo uma opção adicional para suportar cargas de trabalho de IA com agentes que exigem computação de CPU de alto desempenho juntamente com infraestrutura acelerada. Projetada especificamente para a próxima geração de IA, a Vera complementa a estratégia da AWS de oferecer a mais ampla variedade de computação — desde silício personalizado da AWS até os mais recentes aceleradores e CPUs de parceiros.
Infraestrutura de IA Heterogênea Utilizando NVIDIA NVLink Fusion com NVHBM.
Na re:Invent 2025, a AWS anunciou suporte para a tecnologia de interconexão de chips de alta velocidade NVIDIA NVLink Fusion nos chips Trainium de última geração. A NVIDIA e o Annapurna Labs da Amazon estão expandindo esse suporte para trabalhar com a nova tecnologia de memória de alta largura de banda personalizada da NVIDIA (NVHBM) , em parceria com fornecedores de memória, o que daria ao Trainium acesso a memórias mais rápidas e com maior eficiência energética. Combinado com o NVLink Fusion, o Annapurna Labs agora pode aproveitar a tecnologia de memória personalizada da NVIDIA e a arquitetura de escalabilidade para aprimorar o desempenho e a eficiência de cargas de trabalho de IA, integrando perfeitamente o Trainium e as GPUs em uma arquitetura comum de escala de rack.
Impulsionando a IA Federal nos Mais Altos Níveis de Segurança:
Agências governamentais precisam de infraestrutura de IA segura para acompanhar as demandas da segurança nacional. A AWS e a NVIDIA planejam construir fábricas de IA para o governo dos EUA, fornecendo a plataforma de IA da NVIDIA, incluindo planos para disponibilizar 100.000 GPUs na infraestrutura segura da AWS para cargas de trabalho federais e de segurança nacional. Essa colaboração coloca a AWS e a NVIDIA no centro do avanço da IA federal para a segurança nacional, permitindo que agências governamentais implementem IA em escala para cargas de trabalho classificadas no Nível de Impacto 6 (IL6) e superior.
Esses novos compromissos se baseiam em uma sólida integração técnica entre a AWS e a NVIDIA, que já está gerando resultados para os clientes atualmente, incluindo:
- Segurança e confiabilidade aprimoradas com o AWS Nitro System e o EFA — Nesta colaboração ampliada, todas as instâncias EC2 baseadas em GPUs NVIDIA e em Trainium — incluindo aquelas que utilizam o NVLink Fusion — são construídas no AWS Nitro System e interconectadas por meio do EFA. Tanto as instâncias EC2 aceleradas por GPU quanto as baseadas em Trainium continuarão a ser construídas no Nitro System e escaladas horizontalmente por meio do EFA. Juntos, o Nitro e o EFA ajudam a garantir que, à medida que a AWS expande seu parque de GPUs NVIDIA e integra novas tecnologias de interconexão, os clientes mantenham a segurança, a confiabilidade e o desempenho de rede dos quais dependem para cargas de trabalho de IA em produção e em escala.
- Modelos NVIDIA Nemotron na AWS — Como parte do compromisso da AWS em oferecer aos clientes a mais ampla variedade de modelos de IA, a família de modelos abertos Nemotron da NVIDIA está disponível no Amazon Bedrock como modelos totalmente gerenciados e sem servidor, e no Amazon SageMaker para clientes que desejam implantar e otimizar em sua própria infraestrutura. Essa integração oferece aos clientes acesso aos modelos abertos mais recentes da NVIDIA com a segurança, a escalabilidade e as ferramentas operacionais da AWS.
- Processamento de dados acelerado por GPU e indexação vetorial — À medida que os volumes de dados crescem, cargas de trabalho como engenharia de recursos, ETL em larga escala e análises em tempo real exigem processamento cada vez mais rápido. A AWS e a NVIDIA estão colaborando para oferecer processamento de dados acelerado por GPU no Amazon EMR usando instâncias Amazon EC2 G7 e a biblioteca NVIDIA cuDF, proporcionando velocidades de processamento até 3,7 vezes mais rápidas e uma relação custo-benefício 30% melhor em comparação com configurações baseadas em CPU. Além disso, à medida que aplicativos de IA, pipelines de geração com recuperação aprimorada e busca semântica levam os bancos de dados vetoriais a bilhões de registros, a criação e o ajuste de índices se tornam um gargalo. A indexação vetorial acelerada por GPU no Amazon OpenSearch Service transfere a construção de índices para GPUs dedicadas, oferecendo indexação vetorial até 9 vezes mais rápida a um quarto do custo — disponível em clusters gerenciados e no Amazon OpenSearch Serverless.
- Inteligência Artificial Física para Robótica — A Amazon Robotics está colaborando com a NVIDIA para acelerar o desenvolvimento de robôs de última geração, integrando a plataforma completa de IA física da NVIDIA, incluindo a plataforma NVIDIA Jetson™, as bibliotecas NVIDIA Omniverse™ e a plataforma aberta de desenvolvimento de robótica NVIDIA Isaac™. A colaboração abrange simulação, geração de dados sintéticos, treinamento de robôs, otimização de rotas, segurança funcional e validação de simulação em situações reais — tudo executado em instâncias do Amazon EC2 aceleradas por GPU. Juntas, AWS e NVIDIA estão ajudando a aprimorar os recursos que as cargas de trabalho de robótica exigem em escala: simulação massiva, dados de treinamento diversificados e validação contínua em situações reais.
Sobre a Amazon Web Services:
A Amazon Web Services (AWS) é guiada pela obsessão pelo cliente, ritmo de inovação, compromisso com a excelência operacional e visão de longo prazo. Ao democratizar a tecnologia por quase duas décadas e tornar a computação em nuvem e a IA generativa acessíveis a organizações de todos os portes e setores, a AWS construiu um dos negócios de tecnologia empresarial de crescimento mais rápido da história. Milhões de clientes confiam na AWS para acelerar a inovação, transformar seus negócios e moldar o futuro. Com os recursos de IA mais abrangentes e a presença global em infraestrutura, a AWS capacita empreendedores a transformar grandes ideias em realidade. Saiba mais em aws.amazon.com e siga @AWSNewsroom.
Sobre a NVIDIA:
A NVIDIA (NASDAQ: NVDA) é líder mundial em IA e computação acelerada.
Declarações prospectivas da NVIDIA:
Certas declarações neste comunicado de imprensa, incluindo, entre outras, declarações sobre: a expansão da parceria entre a NVIDIA e a AWS em toda a cadeia de valor — GPUs, CPUs, redes, modelos abertos e software — para tornar a IA física e ativa uma realidade em um ritmo e escala sem precedentes que somente a AWS e a NVIDIA podem oferecer; expectativas com relação ao crescimento, desempenho, disponibilidade, demanda e benefícios dos produtos, serviços e tecnologias da NVIDIA, bem como tendências e fatores relacionados; expectativas com relação aos contratos da NVIDIA com terceiros, incluindo a AWS; expectativas com relação aos desenvolvimentos tecnológicos e tendências e fatores relacionados; crescimento e tendências de mercado projetados; expectativas com relação à IA e setores relacionados; e outras declarações que não sejam fatos históricos são declarações prospectivas, conforme definido na Seção 27A da Lei de Valores Mobiliários de 1933, conforme alterada, e na Seção 21E da Lei de Bolsa de Valores de 1934, conforme alterada, que estão sujeitas à “proteção legal” criada por essas seções, com base nas crenças e suposições da administração e nas informações atualmente disponíveis para a administração, e estão sujeitas a riscos e incertezas que podem fazer com que os resultados sejam materialmente diferentes das expectativas. Fatores importantes que podem fazer com que os resultados reais sejam materialmente diferentes incluem: condições econômicas e políticas globais; a dependência da NVIDIA de terceiros para fabricar, montar, embalar e testar os produtos da NVIDIA; o impacto do desenvolvimento tecnológico e da concorrência; o desenvolvimento de novos produtos e tecnologias ou aprimoramentos dos produtos e tecnologias existentes da NVIDIA; a aceitação de mercado dos produtos da NVIDIA ou dos produtos de seus parceiros; defeitos de projeto, fabricação ou software; mudanças nas preferências ou demandas do consumidor; mudanças nos padrões e interfaces do setor; perda inesperada de desempenho dos produtos ou tecnologias da NVIDIA quando integrados a sistemas; a capacidade da NVIDIA de concretizar os benefícios potenciais de investimentos ou aquisições de negócios; e alterações nas leis e regulamentações aplicáveis, bem como outros fatores detalhados periodicamente nos relatórios mais recentes que a NVIDIA apresenta à Comissão de Valores Mobiliários dos EUA (SEC), incluindo, entre outros, seu Relatório Anual no Formulário 10-K e Relatórios Trimestrais no Formulário 10-Q. Cópias dos relatórios apresentados à SEC estão disponíveis no site da empresa e podem ser obtidas gratuitamente junto à NVIDIA. Essas declarações prospectivas não são garantias de desempenho futuro e se referem apenas à data deste documento. Exceto conforme exigido por lei, a NVIDIA se exime de qualquer obrigação de atualizar essas declarações prospectivas para refletir eventos ou circunstâncias futuras.
© 2026 NVIDIA Corporation. Todos os direitos reservados. NVIDIA, o logotipo da NVIDIA, CUDA-X, Nemotron, NVIDIA Isaac, NVIDIA Jetson, NVIDIA Omniverse, NVIDIA RTX PRO, NVIDIA Spectrum e NVLink Fusion são marcas comerciais e/ou marcas registradas da NVIDIA Corporation nos EUA e/ou em outros países. Outros nomes de empresas e produtos podem ser marcas comerciais das respectivas empresas às quais estão associados.






