AWS y NVIDIA planean desplegar dos millones adicionales GPUen toda la infraestructura de AWS durante 2027 y 2028. El despliegue planificado incluirá NVIDIA Blackwell Ultra, Rubin y Rubin Ultra GPUs para entrenamiento de IA, inferencia, computación científica, automatización empresarial y cargas de trabajo de IA física.
El anuncio describe un compromiso futuro con la infraestructura en lugar de dos millones disponibles de inmediato. GPUs. Esto sigue a un plan anterior de AWS para agregar más de un millón NVIDIA GPUa partir de 2026.
Plan de infraestructura ampliada de AWS y NVIDIA
AWS y NVIDIA Anunciaron la ampliación de la asociación el 26 de agosto de 2026. Las dos compañías dijeron que la asociación adicional GPUEstos sistemas se implementarían en toda la infraestructura global de AWS, incluidos los sistemas descritos como fábricas de IA.
La asociación incluye más de GPU capacidad. AWS y NVIDIA También planeamos:
- Introducir infraestructura basada en NVIDIA Procesadores Vera.
- ampliar NVIDIA NVLink Fusion con memoria personalizada de alto ancho de banda.
- Integrar NVIDIA GPUs con AWS Nitro y red Elastic Fabric Adapter.
- Continuar proporcionando NVIDIA Modelos de Nemotron a través de Amazon Bedrock y SageMaker.
- Acelere el procesamiento de datos y la indexación vectorial mediante Amazon EMR y OpenSearch.
- Aplique la plataforma de IA física de NVIDIA a las cargas de trabajo de Amazon Robotics.
Las empresas también planean construir infraestructura de IA para el gobierno de EE. UU. Esto incluye 100,000 GPUs en sistemas AWS seguros destinados a cargas de trabajo federales y de seguridad nacional con nivel de impacto 6 o superior.
Matt Garman, director ejecutivo de AWS, afirmó que los clientes "desean la libertad de elegir las mejores herramientas para sus cargas de trabajo de IA". La AWS conjunta y NVIDIA anuncio Presenta la expansión como una respuesta a las organizaciones que están pasando los proyectos de IA de la fase piloto a la producción.
¿Qué pruebas demuestran que la demanda de infraestructura de IA está creciendo?
Amazon y NVIDIA reportaron un crecimiento sustancial en sus negocios de nube y centro de datos antes de anunciar la adicional GPU despliegue.
Amazon informó que AWS generó 42.2 millones de dólares en ventas durante el segundo trimestre de 2026, un aumento del 37% con respecto al mismo período de 2025. Amazon también indicó que su negocio de IA de AWS superó los 25 millones de dólares en ingresos anuales y que está creciendo a un ritmo de tres dígitos año tras año.
Las compras de propiedades y equipos de Amazon aumentaron en 66.1 millones de dólares en los últimos 12 meses. La compañía atribuyó este aumento principalmente a las inversiones en inteligencia artificial. Resultados del segundo trimestre de Amazon Proporcionar un contexto financiero para el desarrollo de la infraestructura.
NVIDIA La compañía reportó ingresos por centros de datos de 89 mil millones de dólares en su segundo trimestre fiscal de 2027. Esto representó un aumento del 117% con respecto al mismo trimestre del año anterior.
NVIDIA También informó que su plataforma Vera Rubin había entrado en plena producción, con implementaciones de socios que involucran a CoreWeave, Google Cloud, Microsoft Azure, Oracle Cloud Infrastructurey Nebius. Jensen Huang, fundador y director ejecutivo de NVIDIA, dijo: "Y la demanda se está acelerando". Resultados financieros de NVIDIA presentados ante la SEC. Respalde esa afirmación con el crecimiento de los ingresos por centros de datos que reporta la compañía.
Lo que GPU ¿Infraestructura que AWS ya proporciona?
AWS ya proporciona GPU casos basados en varios NVIDIA arquitecturas. El proyecto recientemente anunciado de dos millones de dólaresGPU Su implementación ampliará esta cartera de productos en los próximos dos años.
AWS lanzó instancias EC2 G7 utilizando NVIDIA RTX PRO 4500 Blackwell Server Edition GPUs en junio de 2026. Las configuraciones G7 admiten hasta ocho GPUs, 256 GB de contenido combinado GPU Memoria, 192 CPU virtuales, 768 GiB de memoria del sistema, 7.6 TB de almacenamiento NVMe local y 700 Gbps de ancho de banda de red.
AWS afirma que las instancias G7 ofrecen hasta 4.6 veces el rendimiento de inferencia de IA y 2.1 veces el rendimiento gráfico de la generación anterior G6. Estas son comparaciones reportadas por AWS, no por estudios independientes. HostScore puntos de referencia.
Las instancias G7 estuvieron disponibles inicialmente en las regiones de Ohio Este y Oregón Oeste de EE. UU. a través de configuraciones de instancias bajo demanda, planes de ahorro, instancias spot y configuraciones de instancias dedicadas seleccionadas. El anuncio de AWS sobre EC2 G7 proporciona las especificaciones actuales de las instancias y su disponibilidad regional.
HostScore'apostar
Los dos millones-GPU El compromiso confirma que AWS y NVIDIA Se espera que la demanda de computación para IA siga siendo alta. Sin embargo, el anuncio no establece cuánto costará la nueva capacidad, qué regiones recibirán cada una. GPU modelo, o cuándo estarán disponibles los tipos de instancias individuales.
Posibles efectos en los costos de alojamiento de IA
Una mayor capacidad puede facilitar la disponibilidad del hardware, pero no garantiza precios de alojamiento más bajos. GPU Los costes de alojamiento incluyen el acelerador, la asignación de CPU, la RAM, el almacenamiento, la red, la transferencia de datos, la gestión y la capacidad reservada.
Los sistemas Blackwell Ultra, Rubin y Rubin Ultra también están dirigidos a cargas de trabajo de IA cada vez más exigentes. Estos sistemas pueden ofrecer más trabajo por... GPU, pero eso no reduce automáticamente el coste inicial para proyectos más pequeños.
Los compradores deberían esperar a conocer las especificaciones técnicas, la disponibilidad regional y los precios antes de calcular el impacto financiero de la expansión de AWS.
El papel de los más pequeños GPU Proveedores de alojamiento
AWS es adecuado para organizaciones que necesitan grandes cantidades de recursos. GPU clústeres y una estrecha integración con servicios como Bedrock, SageMaker, OpenSearch, S3 y Elastic Kubernetes Service. No todos los proyectos de IA requieren esa escala o profundidad de plataforma.
Los proveedores de infraestructura especializada pueden atender a las empresas que desean una infraestructura conocida. GPU configuración, acceso directo al servidor, hardware dedicado o un plan de facturación más sencillo. Atlantic.Net, por ejemplo, actualmente ofrece servicios en la nube y dedicados. GPU configuraciones que utilizan NVIDIA Hardware NVL L40S y H100. Sus configuraciones en la nube admiten facturación por hora y a largo plazo, mientras que los servidores dedicados proporcionan hardware fijo y acceso de administrador. Atlantic.Net enumera su actual GPU configuraciones aquí.
Atlantic.Net no es un reemplazo directo para los clústeres distribuidos más grandes de AWS. Representa otra capa de la GPU Mercado de alojamiento para cargas de trabajo más pequeñas de capacitación, inferencia, investigación e infraestructura dedicada.
Implicaciones para el GPU Mercado de alojamiento
Las empresas deben coincidir GPU infraestructura en función de la carga de trabajo, en lugar de la capacidad total del proveedor.
El entrenamiento del modelo depende de GPU memoria, multi-GPU redes, rendimiento de almacenamiento y escalabilidad del clúster. El ajuste fino puede ejecutarse de manera eficiente en un clúster de alta memoria. GPU, dependiendo del modelo y el conjunto de datos. Los compradores de inferencia deben medir la latencia de respuesta, la concurrencia, el tiempo de carga del modelo, la utilización y el costo por solicitud completada. Las cargas de trabajo de larga duración deben comparar los precios de la nube reservada con a dedicados GPU servidores, mientras que los proyectos experimentales se benefician de la facturación por horas y el aprovisionamiento rápido.
El rendimiento de la CPU, la RAM del sistema, el almacenamiento NVMe, el ancho de banda de la red y la configuración del software también afectan. GPU utilización. Un acelerador potente no puede alcanzar su rendimiento esperado si la infraestructura circundante no puede suministrar datos con la suficiente rapidez.