Microsoft está dividiendo deliberadamente su infraestructura de IA de nueva generación entre AMD Helios y Nvidia Vera Rubin para reducir el riesgo en la cadena de suministro y evitar la dependencia de un solo fabricante . Esto refleja el enfoque agnóstico en cuanto a modelos que la compañía ya aplica en Azure y Copilot . El CEO Satya Nadella confirmó que "seremos uno de los primeros proveedores de nube en desplegar infraestructura de IA rack-scale de próxima generación basada en AMD Helios y Nvidia Vera Rubin", lo que le da a Microsoft poder de negociación y flexibilidad operativa si uno de los proveedores enfrenta limitaciones de asignación . En la industria, esta estrategia se describe como "cubrir apuestas" en la contratación de infraestructura de IA .
Ni AMD ni Microsoft han revelado los precios exactos, pero las estimaciones de los analistas del Futurum Group ofrecen una comparación clara:
Esto hace que Helios sea aproximadamente un 40% más caro por rack . La prima refleja la mayor capacidad de memoria de Helios, su arquitectura abierta y la cartera integrada de CPU-GPU-redes de AMD .
AMD argumenta que el mayor costo inicial de Helios se justifica por una eficiencia de rendimiento superior. Según los datos de laboratorio de la propia AMD, Helios ofrece :
La CEO de AMD, Lisa Su, presentó estas cifras en el evento Advancing AI 2026, afirmando que Helios ofrece "un 15% o más de rendimiento que la competencia en los modelos más grandes, un 50% más de capacidad HBM y hasta un 30% más de tokens por dólar" .
Sin embargo, los analistas advierten que se trata de estimaciones previas a la producción. El Futurum Group señaló que "la ventaja de rendimiento del 15% de AMD y las afirmaciones de un 30% más de tokens por dólar siguen siendo matemáticas de proveedor contra un competidor que aún no se ha enviado, y se pondrán a prueba en producción en un par de trimestres" .
AMD Helios es un sistema rack-scale construido a medida, con refrigeración líquida, que representa la oferta de hardware de IA más completa de la compañía hasta la fecha :
| Componente | Especificación |
|---|---|
| GPU | 72x AMD Instinct MI455X |
| Arquitectura de GPU | CDNA 5 (híbrido de chiplets de 2 nm/3 nm en TSMC) |
| Transistores por GPU | 320 mil millones |
| CPU | 18x AMD EPYC "Venice" de 6.ª generación (una por bandeja de cómputo, hasta 256 núcleos por CPU) |
| Redes | AMD Pensando "Vulcano" 800 AI NICs (Ethernet de 800 Gbps, hasta 2,4 Tbps de ancho de banda de escalado por GPU) |
| Interconexión de escalado interno | UALink (Ultra Accelerator Link tunelizado sobre Ethernet) |
| Interconexión de escalado externo | Alineada con Ultra Ethernet Consortium (UEC) |
| Memoria HBM4 total | 31 TB por rack |
| Memoria por GPU | 432 GB (12 stacks de HBM4 de 36 GB cada uno) |
| Ancho de banda de memoria por GPU | 19,6 TB/s |
| Ancho de banda de memoria agregado | 1,7 PB/s por rack |
| Rendimiento FP4 | 2,9 exaFLOPS por rack |
| Rendimiento FP8 | 1,4 exaFLOPS por rack |
| Ancho de banda de escalado interno | 260 TB/s |
| Ancho de banda de escalado externo | 43 TB/s |
| Factor de forma | 18 bandejas de cómputo refrigeradas por líquido (4 GPU cada una) + 6 bandejas de conmutación, compatible con OCP Open Rack Wide |
| Rendimiento por GPU | 40 PFLOPS FP4, 20 PFLOPS FP8 |
Cada bandeja de cómputo contiene cuatro GPU MI455X emparejadas con una única CPU EPYC Venice y redes Pensando, todo conectado mediante el protocolo UALink para que las 72 GPU funcionen como una sola unidad de cómputo .
AMD ha conseguido los siguientes clientes iniciales confirmados para Helios :
Una ausencia notable: Anthropic no ha sido nombrado públicamente como cliente inicial de Helios en ningún anuncio importante hasta julio de 2026 .
La decisión de Microsoft de desplegar tanto AMD Helios como Nvidia Vera Rubin señala que el mercado de hardware de IA ha entrado en una nueva fase. En lugar de depender de un solo proveedor, los hiperescaladores están invirtiendo en la diversidad de plataformas para asegurar el suministro, mejorar su poder de negociación y acceder a características de rendimiento diferenciadas .
AMD Helios, con sus masivos 31 TB de memoria HBM4 y su interconexión abierta basada en Ethernet, es particularmente adecuado para cargas de trabajo de inferencia a gran escala, donde la capacidad y el ancho de banda de la memoria impulsan directamente el rendimiento y el costo por token . Con los envíos previstos para la segunda mitad de 2026, la verdadera prueba llegará cuando se publiquen los benchmarks de producción y las afirmaciones contrapuestas puedan verificarse a escala .