El 26 de agosto de 2026, Amazon Web Services (AWS) y NVIDIA anunciaron una ampliación de su colaboración estratégica para responder al aumento de la demanda de infraestructura de inteligencia artificial. El acuerdo contempla el despliegue de dos millones de GPU adicionales de NVIDIA en la infraestructura global de AWS entre 2027 y 2028, junto con nuevas integraciones en computación, redes, modelos abiertos, procesamiento de datos y robótica.
La capacidad adicional estará destinada a cargas de trabajo que incluyen IA agentiva, descubrimiento científico, automatización empresarial y física, un ámbito que abarca la robótica y otros sistemas capaces de interactuar con el entorno. Las compañías aseguran que los clientes están trasladando sus proyectos desde las fases piloto a entornos de producción y necesitan más opciones de modelos, canalizaciones de datos más rápidas y una infraestructura capaz de mantener el ritmo de esa expansión.
El despliegue incluirá GPU NVIDIA Blackwell Ultra, Rubin y Rubin Ultra. AWS también ampliará la capacidad basada en NVIDIA Blackwell, incluidas las GPU NVIDIA RTX PRO 4500 Blackwell Server Edition para las instancias Amazon EC2 G7. Según la compañía, estas instancias ofrecen 4,6 veces más rendimiento en inferencia de IA y 2,1 veces más rendimiento gráfico que las instancias G6 de la generación anterior. AWS será el primer gran proveedor de servicios en la nube que ofrecerá instancias aceleradas por RTX PRO 4500.
La colaboración también contempla llevar a AWS infraestructura basada en las CPU NVIDIA Vera, orientada a cargas de IA agentiva que necesitan computación de propósito general de alto rendimiento junto con aceleradores. NVIDIA y AWS trabajarán además con NVIDIA NVLink Fusion y la memoria de alto ancho de banda personalizada NVIDIA NVHBM. Esta tecnología se integrará con los chips Trainium de próxima generación de AWS, lo que permitiría combinar Trainium y GPU en una arquitectura común a escala de rack.
En el ámbito de las redes, AWS y NVIDIA colaborarán en NVIDIA Spectrum para optimizar el rendimiento de las comunicaciones entre grandes grupos de GPU durante el entrenamiento de modelos. Las instancias de Amazon EC2 basadas tanto en GPU de NVIDIA como en Trainium seguirán utilizando AWS Nitro System y Elastic Fabric Adapter (EFA), una integración que las compañías vinculan con mejoras de seguridad, fiabilidad y rendimiento de red para cargas de IA en producción.
El acuerdo incluye asimismo planes para construir fábricas de IA destinadas al Gobierno de Estados Unidos. AWS y NVIDIA prevén proporcionar 100.000 GPU en infraestructura segura de AWS para cargas federales y de seguridad nacional, incluidas aquellas clasificadas en Impact Level 6 (IL6) y superiores.
En software y modelos, NVIDIA Nemotron continuará disponible en Amazon Bedrock como modelos gestionados y sin servidor, así como en Amazon SageMaker para clientes que quieran desplegarlos y ajustarlos en su propia infraestructura. Las empresas también acelerarán el procesamiento de datos y la indexación vectorial en Amazon EMR y Amazon OpenSearch mediante las bibliotecas NVIDIA cuDF y cuVS de CUDA-X, con el objetivo de mejorar el rendimiento y la eficiencia de las aplicaciones de análisis e inteligencia artificial.
La robótica será otra de las áreas prioritarias. Amazon Robotics adoptará la plataforma de física de NVIDIA para impulsar la automatización de almacenes y el desarrollo de robots de nueva generación. El anuncio amplía una relación tecnológica que AWS y NVIDIA mantienen desde hace 16 años y que, según ambas compañías, ahora se extenderá por toda la pila de IA: GPU, CPU, redes, modelos abiertos y software.
Fuente: NVIDIA.