Nvidia y Amazon anuncian expansión de capacidad: AWS implementará 2 millones de GPU adicionales en 2027-2028

📅 2026-08-27

Resumen:

El 26 de agosto, hora local en Seattle y Santa Clara, California, Amazon Cloud Technology (AWS) y NVIDIA publicaron simultáneamente una declaración de expansión de cooperación estratégica: AWS planea implementar 2 millones de procesadores gráficos NVIDIA adicionales en su infraestructura global de 2027 a 2028, con modelos de chips que incluyen Blackwell Ultra, Rubin y Rubin Ultra. Las partes no anunciaron el monto del contrato. El mismo día, Nvidia dijo en una conferencia telefónica sobre resultados que Amazon utilizará su conjunto completo de tecnología de inteligencia artificial física para robots de almacén.

Hace aproximadamente cinco meses, AWS anunció en la conferencia NVIDIA GTC de 2026 que agregaría más de 1 millón de GPU NVIDIA a partir de 2026. Las dos compañías dijeron esta vez que se había superado la demanda de ese nivel. Según el calibre oficial, el nuevo compromiso es agregar 2 millones de unidades adicionales al plan original, elevando la escala de despliegue total a más de 3 millones de unidades. El monto del contrato, el precio unitario y el ritmo de entrega anual aún no se han revelado.

>

AWS instalará otros 2 millones de GPU entre 2027 y 2028

El comunicado de prensa conjunto indicó que los 2 millones de GPU adicionales se implementarán en la infraestructura global de AWS, cubriendo la llamada "fábrica de inteligencia artificial" y las instancias de nube orientadas al cliente. Los usos se enumeran en varias categorías: IA inteligente, informática científica, automatización empresarial e IA física. El director financiero de Nvidia, Kress, añadió en la conferencia de resultados que también se proporcionará a AWS un número no revelado de procesadores centrales Vera, algunos integrados con Rubin y otros entregados por separado.

Ambas partes escribieron simultáneamente la interconexión de alta velocidad NVLink Fusion de NVIDIA y la memoria personalizada de gran ancho de banda (NVHBM) en el rack Trainium de próxima generación. El sitio web oficial de Amazon afirma que la próxima generación de Trainium se anunció en re:Invent en 2025 para admitir NVLink Fusion; Esta vez, la memoria personalizada de NVIDIA está conectada a la misma arquitectura de rack, de modo que las GPU Trainium y NVIDIA se pueden expandir en el mismo gabinete. Wccftech citó los materiales de NVIDIA de ese día diciendo que NVHBM tiene aproximadamente un 30% más de ancho de banda y aproximadamente un 15% más de eficiencia energética que HBM4E. Estos indicadores provienen del calibre del proveedor y las dos partes no proporcionaron muestras de control medidas reales.

AWS también ampliará la capacidad de Blackwell y proporcionará GPU RTX PRO 4500 Blackwell Server Edition en instancias Amazon EC2 G7. Según el comunicado de prensa, en comparación con la generación anterior del G6, el G7 tiene un rendimiento máximo de inferencia de inteligencia artificial de aproximadamente 4,6 veces y un rendimiento de gráficos de aproximadamente 2,1 veces. AWS es el primer gran proveedor de nube que proporciona esta instancia de tarjeta aceleradora.

El fundador y director ejecutivo de NVIDIA, Jensen Huang, dijo en el comunicado: "NVIDIA y AWS han construido uno de los motores de crecimiento en la era de la inteligencia artificial, y la demanda está por delante de cualquier pronóstico. Durante los últimos 16 años, hemos trabajado juntos para llevar la informática de NVIDIA a la nube. Ahora la cooperación se ha expandido al conjunto completo: GPU, CPU, red, modelos de código abierto y software". Garman, director ejecutivo de AWS, dijo que los clientes deben poder elegir herramientas y confirmar que todas las capas se pueden conectar, por lo que AWS ha realizado optimizaciones profundas con NVIDIA en términos de red, seguridad e implementación.

Las dos compañías no explicaron cuántos de cada modelo representaron los 2 millones de unidades, qué centros de datos se instalarán primero y cómo se combinarán la energía y la refrigeración. TechCrunch estima, basándose en el rango de precios de una sola tarjeta, que el acuerdo completo puede alcanzar decenas de miles de millones de dólares, pero el artículo original también dice: Ambas partes no han anunciado los términos financieros.

>

Los robots de almacén están conectados a la pila completa de inteligencia artificial física de NVIDIA

Kress dijo en la llamada que Amazon utilizará toda la tecnología de inteligencia artificial física de Nvidia para impulsar los robots de almacén. El comunicado de prensa divide la pila de tecnología en varias partes: la plataforma de computación de borde Jetson, la simulación Omniverse y la biblioteca de gemelos digitales, y la plataforma de desarrollo de robots de código abierto Isaac. El sitio web oficial de Amazon también indica que el Departamento de Robótica de Amazon utilizará las herramientas anteriores para simulación, datos sintéticos, optimización de rutas, seguridad funcional y verificación "real a simulación", y los cálculos se ejecutarán en instancias de Amazon EC2 aceleradas por GPU. TechCrunch también enumera la plataforma modelo mundial Cosmos.

El comunicado no proporcionó el número de robots conectados, la lista de almacenes en línea ni el calendario de transformación. La cooperación en el lado del almacenamiento y los 2 millones de GPU en el lado de la nube son términos paralelos y no están escritos en la misma orden de compra.

La capa de software se escribe en conjunto. El modelo de código abierto Nemotron de Nvidia sigue estando disponible en Amazon Bedrock y SageMaker. La biblioteca cuDF se utiliza en Amazon EMR para el procesamiento de datos acelerado por GPU. El comunicado de prensa afirma que la velocidad de procesamiento es hasta aproximadamente 3,7 veces y el rendimiento de costos es aproximadamente un 30% mayor que el de una configuración de CPU pura. Amazon OpenSearch utiliza la GPU para la indexación de vectores y se dice que la velocidad de indexación es de hasta aproximadamente 9 veces y el costo es de aproximadamente una cuarta parte. Los múltiplos anteriores provienen todos del calibre de prueba del fabricante. La capa de seguridad conecta la plataforma NVIDIA con el sistema AWS Nitro y el Elastic Fabric Adapter (EFA).

100.000 GPU para el gobierno de EE. UU. se enumeran por separado

Las dos partes planean construir una "fábrica de inteligencia artificial" para el gobierno de EE. UU., entregando 100 000 GPU en la infraestructura segura de AWS para ejecutar cargas de trabajo de seguridad federal y nacional con un nivel de confidencialidad de Nivel de Impacto 6 (IL6) y superior. Las 100.000 piezas son el número que figura por separado en el comunicado. No se especifica si se incluye entre los 2 millones de unidades antes mencionados, ni se anuncia el año de entrega ni el lugar de construcción.

Amazon también destacó que los chips de desarrollo propio todavía están a la venta. Según informes de los medios, el negocio de chips de desarrollo propio de Amazon tiene unos ingresos anuales de aproximadamente 25 mil millones de dólares y tiene un compromiso de aproximadamente 225 mil millones de dólares de su laboratorio de inteligencia artificial; Trainium se posiciona como una opción que se puede utilizar junto con las tarjetas aceleradoras Nvidia. Esta expansión coloca a Nvidia GPU, Vera CPU y Trainium en la misma narrativa de rack, y los clientes pueden mezclarlos, y el cliente elige la proporción específica. Ninguno de los dos partidos ha anunciado la hora de lanzamiento del gabinete mixto.

Nvidia anunció el mismo día que sus ingresos para el segundo trimestre del año fiscal 2027 fueron de 96.200 millones de dólares, con ingresos por centros de datos de 89.000 millones de dólares, un aumento interanual del 117%; su previsión de ingresos para el tercer trimestre fue de 108.000 millones de dólares, más o menos un 2%. Huang Renxun dijo en una entrevista relacionada con el informe financiero que la inteligencia artificial ha entrado en la etapa de "producir trabajo útil y hacer que los tokens sean rentables", y más potencia informática significa más tokens. La declaración de expansión se publicó el mismo día que el informe financiero, pero el texto de cooperación en sí no convirtió los 2 millones de GPU en una contribución a los ingresos de Nvidia.

Etiquetas relacionadas

Artículos relacionados

Comentarios

0/500
验证码
Sin comentarios