AMD Helios: 72 GPUs, 31 TB de memoria y Microsoft ya lo compra para Azure — el rival más serio que Nvidia ha tenido en infraestructura de IA
AMD lanzó Helios, su sistema rack-scale con 72 GPUs Instinct MI455X, 31 TB de HBM4 y 2.9 exaFLOPS FP4. Microsoft Azure, Meta y Oracle ya firmaron. Esto es lo que cambia.
Durante años el playbook de AMD en IA fue el mismo: lanzar una GPU con buenos specs en papel, no tener el software listo, y ver cómo los data centers seguían comprando Nvidia. Con Helios, eso puede estar cambiando. Y no es puro hype: Microsoft ya firmó.
Qué es el Helios y por qué importa
AMD presentó Helios en el evento Advancing AI 2026 celebrado en San Francisco la semana pasada. No es una GPU sola: es un sistema rack-scale completo. Un rack doble, refrigerado por líquido, que pesa casi 3,200 kg y que mete dentro todo lo siguiente:
- 72 GPUs Instinct MI455X (arquitectura CDNA 5, proceso de 2nm)
- 18 CPUs EPYC “Venice” de 6ta generación (un CPU por tray, cuatro GPUs por tray)
- 31 TB de HBM4 en total (432 GB por GPU)
- 1.7 PB/s de ancho de banda de memoria a nivel de rack
- 2.9 exaFLOPS FP4 / 1.4 exaFLOPS FP8 de cómputo pico
- AMD Pensando Vulcano 800 AI NICs para networking
La comparación directa es contra el Vera Rubin NVL72 de Nvidia, y según AMD en su lanzamiento oficial, Helios entrega: 15% más cómputo FP4, 50% más capacidad de HBM y hasta 30% más tokens por dólar.
Números en papel. Ya sé. Pero hay algo más interesante que los flops.
La apuesta real: open standards vs el jardín amurallado de Nvidia
Aquí está el ángulo que no te cuentan en el comunicado de prensa: Helios está construido sobre estándares abiertos. Para la interconexión dentro del rack (scale-up), usa UALink sobre Ethernet (UALoE). Para conectar racks entre sí (scale-out), usa el estándar de la Ultra Ethernet Consortium.
Nvidia, en cambio, usa NVLink para todo, que es propietario. Si compras NVL72, estás dentro del ecosistema de Nvidia y de ahí no te mueves fácil.
AMD está apostando a que las empresas, en especial los hyperscalers, van a preferir no depender de un solo proveedor. Y Microsoft le creyó. Como lo hemos visto con la estrategia de Microsoft de diversificar sus apuestas en IA, Redmond no quiere estar a merced de nadie, ni siquiera de Nvidia.
Microsoft, Meta, Oracle y el resto de la lista
AMD confirmó en su investor relations que Microsoft desplegará Helios “a escala” en Azure. Las instancias se llaman ND MI455X v7 y están orientadas a inferencia a escala. También hay VMs de CPU (HDv2 y HXv2) basadas en Venice para data prep y simulaciones.
Los otros clientes confirmados son Meta, Oracle, OpenAI, Anthropic y Tata Consultancy Services. Meta y OpenAI juntos tienen pedidos que suman 12 gigawatts de capacidad de aceleradores AMD, lo cual es una cantidad absurdamente grande de hardware. Para darte contexto: un gigawatt es lo que consume una ciudad mediana.
La adopción de Azure es la más simbólica porque valida el estándar UALink que AMD y Microsoft co-desarrollaron. Si el mayor cloud del mundo lo mete en producción, otros hyperscalers van a tener que justificar muy bien por qué no lo hacen.
Los specs reales del MI455X
La GPU en sí es la clave. Comparada con la Instinct MI355X anterior y con los aceleradores de Nvidia, la MI455X tiene algunos números interesantes:
| Característica | MI455X (Helios) | Nvidia Rubin (NVL72) |
|---|---|---|
| Memoria por GPU | 432 GB HBM4 | ~288 GB HBM3e |
| BW de memoria | 23.3 TB/s | ~22 TB/s |
| Scale-up BW | 260 TB/s (rack) | 259 TB/s (rack) |
| Scale-out BW | 2,400 Gb/s por GPU | ~1,600 Gb/s |
| Proceso | 2nm | 3nm |
50% más HBM es una chimba para modelos grandes: puedes correr LLMs masivos con menos GPUs, lo que simplifica la arquitectura y potencialmente reduce costos.
El bandwidth de scale-up (dentro del rack) es prácticamente igual al NVLink de Nvidia. Donde AMD gana es en scale-out: 50% más ancho de banda entre racks, lo que importa mucho para clústeres de miles de GPUs.
El precio y el timing
Según análisis de Tech Insider sobre el evento Advancing AI 2026, el precio de un rack Helios ronda los $5.25 millones de dólares. No es hardware para tu clóset. Esto es infraestructura de empresa Fortune 500 o gobierno.
Para los envíos: los primeros racks en ingeniería llegarán en Q3 2026 y escalarán durante Q4. La producción masiva está programada para Q2 2027. Y AMD ya anunció el roadmap: MI500 en 2027, MI600 en 2028. Están apostando a cadencia anual para no perder terreno contra Nvidia.
El pedo del software, que siempre ha sido el pedo
Aquí no te voy a mentir: el elefante en el cuarto de AMD en IA siempre ha sido ROCm vs CUDA. El software de Nvidia sigue siendo mucho más maduro, con más soporte de frameworks, más documentación y más ingenieros que saben usarlo.
Como mencionamos cuando DeepSeek cambió el panorama de los modelos baratos, la democratización del software de IA está cambiando las reglas, y AMD ha estado invirtiendo fuerte en ROCm durante los últimos dos años. Pero “invirtiendo fuerte” no es lo mismo que “ya alcanzó a CUDA”. Los benchmarks reales de Mixture-of-Experts, que son los modelos que todos están corriendo ahorita, no están publicados por fuentes independientes todavía.
El riesgo real para los clientes de Azure que corran Helios: que el hardware les entregue los flops prometidos, pero que tengan que hacer más trabajo de ingeniería que con Nvidia para sacarle el jugo. Para hyperscalers con equipos enormes, eso se puede absorber. Para una startup mediana, puede ser un dolor de cabeza.
Qué significa esto para el mercado
Nvidia tuvo un monopolio de facto en infraestructura de IA por un buen rato. AMD con Helios no lo derroca de un día para otro, pero sí introduce una alternativa real. Y lo que más le conviene al ecosistema es exactamente eso: que haya competencia.
Microsoft apostando por hardware AMD en Azure le da a cualquier empresa que use Azure la posibilidad de correr cargas de trabajo en GPUs no-Nvidia. Eso tiene implicaciones en precios a largo plazo. Si Nvidia sabe que puede perder contratos a favor de AMD, tiene menos poder de negociación.
Y como apuntamos antes con los movimientos de Microsoft en IA alrededor del mundo, Redmond está construyendo una infraestructura que no dependa de ningún proveedor único. Helios encaja perfecto en esa estrategia.
¿Será AMD la navaja que le quite a Nvidia su dominio? No va a pasar de un jalón. Pero es la primera vez en años que Nvidia tiene un competidor con hardware creíble, respaldo de hyperscalers reales y un argumento técnico de peso.
La pelota está en la cancha del software. Si ROCm madura en los próximos 12 meses al ritmo que AMD promete, el duopolio de IA se vuelve real. Si no, Helios se quedará como el mejor intento de AMD hasta la fecha, pero un intento que no terminó de cerrar.
¿Tú le apostarías a AMD o crees que Nvidia sigue siendo intocable? Échenlo en los comentarios.
Fuentes
- AMD Newsroom: AAI 2026: AMD Launches Helios Rackscale Solution
- StorageReview: AMD MI455X and Helios, 432GB HBM4, 72-GPU Racks
- AMD Investor Relations: Microsoft to Deploy Next-Gen AMD Instinct and EPYC
- The Next Web: AMD’s Helios puts 72 GPUs and 31 terabytes of HBM4 in one rack
- Tech Insider: AMD Advancing AI 2026, Helios Rack Hits $5.25M
- Phoronix: AMD Launches Instinct MI455X, Helios AI Rack
Comentarios
No te pierdas ningún post
Recibe lo nuevo de Al Chile Tech directo en tu correo. Sin spam.
También te puede interesar
NVIDIA Vera Rubin ya está aquí: el sucesor de Blackwell que promete bajar 10x el costo de la IA para empresas en México
NVIDIA presentó Vera Rubin en CES y GTC 2026: 50 petaflops por GPU, 10x menos costo por token que Blackwell, y llega a AWS, Azure y Google Cloud en el segundo semestre de 2026. Esto es lo que cambia para los negocios mexicanos.
Nvidia, Microsoft e IBM forman la alianza de seguridad IA más grande del mundo: y no invitaron a OpenAI, Anthropic ni Google
La Open Secure AI Alliance lanzó el 27 de julio con 40+ empresas para defender sistemas IA con herramientas open source. El catalizador: el hackeo autónomo de GPT-5.6 Sol a Hugging Face.
Nvidia va a garantizar $250,000 millones para el data center de OpenAI: el acuerdo de $500,000 millones que explica por qué la IA nunca fue tan concentrada
Nvidia avala el dinero para que OpenAI rente el campus, OpenAI usa ese dinero para comprar chips de Nvidia. Así funciona el bucle de capital que está concentrando toda la infraestructura de IA en tres empresas, y lo que significa para devs y startups en México.