AMD ficha a Microsoft como cliente estrella de su sistema de IA a escala de rack Helios
Microsoft desplegará los racks Helios de AMD en Azure a gran escala para inferencia de modelos frontera, dándole a Nvidia su primer rival creíble a nivel de rack justo cuando AMD celebra su conferencia Advancing AI 2026.
AMD confirmó el 20 de julio que Microsoft Azure desplegará su sistema de IA a escala de rack Helios “a gran escala”, convirtiendo a Microsoft en el cliente estrella de la plataforma justo dos días antes de que arranque la conferencia Advancing AI 2026 de AMD en San Francisco.
Helios es la respuesta de AMD al dominio de Nvidia a nivel de rack con sus sistemas GB200/GB300 NVL72. Cada rack ofrece 1,4 exaFLOPS de cómputo y 31 terabytes de memoria HBM4, construido sobre las GPU MI450 y MI455X con la nueva arquitectura CDNA 5. El compromiso de Microsoft cubre tanto sus propias cargas de trabajo de modelos frontera como capacidad de inferencia que revende a sus clientes de Azure — una señal de que un hyperscaler está dispuesto a mover tráfico de producción de IA sobre silicio que no es de Nvidia a un volumen significativo, no solo en pilotos.
Microsoft no es el único cliente. Meta se comprometió en febrero a desplegar hasta 6 gigavatios de GPU de AMD a lo largo del tiempo, con un primer gigavatio de racks Helios llegando este año. Oracle, OpenAI y la india Tata Consultancy Services también se han sumado como implementadores tempranos. Las muestras de ingeniería y la producción a bajo volumen empiezan en la segunda mitad de 2026, con AMD apuntando a una rampa de producción masiva para el segundo trimestre de 2027.
El momento importa. La acción de AMD ha subido cerca de un 150% en lo que va de año frente al modesto 13% de Nvidia, aunque Nvidia sigue controlando entre el 70% y el 85% del mercado de aceleradores de IA y el ecosistema CUDA sigue siendo un foso formidable. Un despliegue de producción con un hyperscaler identificado es una señal distinta a una subida bursátil — es evidencia de que hay compradores dispuestos a construir y validar toda una pila de inferencia sobre el software ROCm de AMD en lugar de tratarlo como un plan B. Advancing AI 2026, que se celebra el 22 y 23 de julio, es donde AMD y Microsoft copresentarán sesiones sobre IA soberana e infraestructura a escala de producción — es de esperar que allí salgan cifras de despliegue y precios más concretos.
Para los equipos de infraestructura, que Helios aterrice en Azure es la prueba más clara hasta ahora de que la planificación multi-proveedor de silicio de IA ya no es opcional. Que eso se traduzca en una inferencia significativamente más barata dependerá de cómo Microsoft fije el precio de la capacidad respaldada por Helios frente a sus ofertas basadas en Nvidia — la cifra que habrá que vigilar en cuanto Azure la publique.
Fuentes
Lecturas relacionadas
- Hardware AMD compra Taalas, la startup que graba modelos de IA directamente en el silicio
- Hardware Nvidia prepara una tercera subida de precios de GPU en 2026 de hasta el 30% por la escasez de memoria para IA
- Hardware Nvidia alcanza un récord de 81.600 millones en el primer trimestre, orienta hacia 91.000 millones para el Q2 y multiplica el dividendo por 25