ia

AMD Helios: 72 GPUs, 31 TB de memoria y Microsoft ya lo compra para Azure — el rival más serio que Nvidia ha tenido en infraestructura de IA

ia · 6 min de lectura

AMD Helios: 72 GPUs, 31 TB de memoria y Microsoft ya lo compra para Azure — el rival más serio que Nvidia ha tenido en infraestructura de IA

AMD lanzó Helios, su sistema rack-scale con 72 GPUs Instinct MI455X, 31 TB de HBM4 y 2.9 exaFLOPS FP4. Microsoft Azure, Meta y Oracle ya firmaron. Esto es lo que cambia.

AMD Helios: 72 GPUs, 31 TB de memoria y Microsoft ya lo compra para Azure — el rival más serio que Nvidia ha tenido en infraestructura de IA

Durante años el playbook de AMD en IA fue el mismo: lanzar una GPU con buenos specs en papel, no tener el software listo, y ver cómo los data centers seguían comprando Nvidia. Con Helios, eso puede estar cambiando. Y no es puro hype: Microsoft ya firmó.

Qué es el Helios y por qué importa

AMD presentó Helios en el evento Advancing AI 2026 celebrado en San Francisco la semana pasada. No es una GPU sola: es un sistema rack-scale completo. Un rack doble, refrigerado por líquido, que pesa casi 3,200 kg y que mete dentro todo lo siguiente:

  • 72 GPUs Instinct MI455X (arquitectura CDNA 5, proceso de 2nm)
  • 18 CPUs EPYC “Venice” de 6ta generación (un CPU por tray, cuatro GPUs por tray)
  • 31 TB de HBM4 en total (432 GB por GPU)
  • 1.7 PB/s de ancho de banda de memoria a nivel de rack
  • 2.9 exaFLOPS FP4 / 1.4 exaFLOPS FP8 de cómputo pico
  • AMD Pensando Vulcano 800 AI NICs para networking

La comparación directa es contra el Vera Rubin NVL72 de Nvidia, y según AMD en su lanzamiento oficial, Helios entrega: 15% más cómputo FP4, 50% más capacidad de HBM y hasta 30% más tokens por dólar.

Números en papel. Ya sé. Pero hay algo más interesante que los flops.

La apuesta real: open standards vs el jardín amurallado de Nvidia

Aquí está el ángulo que no te cuentan en el comunicado de prensa: Helios está construido sobre estándares abiertos. Para la interconexión dentro del rack (scale-up), usa UALink sobre Ethernet (UALoE). Para conectar racks entre sí (scale-out), usa el estándar de la Ultra Ethernet Consortium.

Nvidia, en cambio, usa NVLink para todo, que es propietario. Si compras NVL72, estás dentro del ecosistema de Nvidia y de ahí no te mueves fácil.

AMD está apostando a que las empresas, en especial los hyperscalers, van a preferir no depender de un solo proveedor. Y Microsoft le creyó. Como lo hemos visto con la estrategia de Microsoft de diversificar sus apuestas en IA, Redmond no quiere estar a merced de nadie, ni siquiera de Nvidia.

Microsoft, Meta, Oracle y el resto de la lista

AMD confirmó en su investor relations que Microsoft desplegará Helios “a escala” en Azure. Las instancias se llaman ND MI455X v7 y están orientadas a inferencia a escala. También hay VMs de CPU (HDv2 y HXv2) basadas en Venice para data prep y simulaciones.

Los otros clientes confirmados son Meta, Oracle, OpenAI, Anthropic y Tata Consultancy Services. Meta y OpenAI juntos tienen pedidos que suman 12 gigawatts de capacidad de aceleradores AMD, lo cual es una cantidad absurdamente grande de hardware. Para darte contexto: un gigawatt es lo que consume una ciudad mediana.

La adopción de Azure es la más simbólica porque valida el estándar UALink que AMD y Microsoft co-desarrollaron. Si el mayor cloud del mundo lo mete en producción, otros hyperscalers van a tener que justificar muy bien por qué no lo hacen.

Los specs reales del MI455X

La GPU en sí es la clave. Comparada con la Instinct MI355X anterior y con los aceleradores de Nvidia, la MI455X tiene algunos números interesantes:

CaracterísticaMI455X (Helios)Nvidia Rubin (NVL72)
Memoria por GPU432 GB HBM4~288 GB HBM3e
BW de memoria23.3 TB/s~22 TB/s
Scale-up BW260 TB/s (rack)259 TB/s (rack)
Scale-out BW2,400 Gb/s por GPU~1,600 Gb/s
Proceso2nm3nm

50% más HBM es una chimba para modelos grandes: puedes correr LLMs masivos con menos GPUs, lo que simplifica la arquitectura y potencialmente reduce costos.

El bandwidth de scale-up (dentro del rack) es prácticamente igual al NVLink de Nvidia. Donde AMD gana es en scale-out: 50% más ancho de banda entre racks, lo que importa mucho para clústeres de miles de GPUs.

El precio y el timing

Según análisis de Tech Insider sobre el evento Advancing AI 2026, el precio de un rack Helios ronda los $5.25 millones de dólares. No es hardware para tu clóset. Esto es infraestructura de empresa Fortune 500 o gobierno.

Para los envíos: los primeros racks en ingeniería llegarán en Q3 2026 y escalarán durante Q4. La producción masiva está programada para Q2 2027. Y AMD ya anunció el roadmap: MI500 en 2027, MI600 en 2028. Están apostando a cadencia anual para no perder terreno contra Nvidia.

El pedo del software, que siempre ha sido el pedo

Aquí no te voy a mentir: el elefante en el cuarto de AMD en IA siempre ha sido ROCm vs CUDA. El software de Nvidia sigue siendo mucho más maduro, con más soporte de frameworks, más documentación y más ingenieros que saben usarlo.

Como mencionamos cuando DeepSeek cambió el panorama de los modelos baratos, la democratización del software de IA está cambiando las reglas, y AMD ha estado invirtiendo fuerte en ROCm durante los últimos dos años. Pero “invirtiendo fuerte” no es lo mismo que “ya alcanzó a CUDA”. Los benchmarks reales de Mixture-of-Experts, que son los modelos que todos están corriendo ahorita, no están publicados por fuentes independientes todavía.

El riesgo real para los clientes de Azure que corran Helios: que el hardware les entregue los flops prometidos, pero que tengan que hacer más trabajo de ingeniería que con Nvidia para sacarle el jugo. Para hyperscalers con equipos enormes, eso se puede absorber. Para una startup mediana, puede ser un dolor de cabeza.

Qué significa esto para el mercado

Nvidia tuvo un monopolio de facto en infraestructura de IA por un buen rato. AMD con Helios no lo derroca de un día para otro, pero sí introduce una alternativa real. Y lo que más le conviene al ecosistema es exactamente eso: que haya competencia.

Microsoft apostando por hardware AMD en Azure le da a cualquier empresa que use Azure la posibilidad de correr cargas de trabajo en GPUs no-Nvidia. Eso tiene implicaciones en precios a largo plazo. Si Nvidia sabe que puede perder contratos a favor de AMD, tiene menos poder de negociación.

Y como apuntamos antes con los movimientos de Microsoft en IA alrededor del mundo, Redmond está construyendo una infraestructura que no dependa de ningún proveedor único. Helios encaja perfecto en esa estrategia.

¿Será AMD la navaja que le quite a Nvidia su dominio? No va a pasar de un jalón. Pero es la primera vez en años que Nvidia tiene un competidor con hardware creíble, respaldo de hyperscalers reales y un argumento técnico de peso.

La pelota está en la cancha del software. Si ROCm madura en los próximos 12 meses al ritmo que AMD promete, el duopolio de IA se vuelve real. Si no, Helios se quedará como el mejor intento de AMD hasta la fecha, pero un intento que no terminó de cerrar.

¿Tú le apostarías a AMD o crees que Nvidia sigue siendo intocable? Échenlo en los comentarios.

Fuentes

Comentarios

No te pierdas ningún post

Recibe lo nuevo de Al Chile Tech directo en tu correo. Sin spam.

También te puede interesar