AMD lanza Helios rack; 15% más compute, 30% mejores tokens/dólar que Vera Rubin
AMD lanzó oficialmente Helios, su primer sistema rack-scale de IA, en Advancing AI 2026 en San Francisco el 23 de julio. El sistema combina 72 GPU AMD Instinct MI455X con CPU EPYC Venice de 6à generación y networking Pensando en un rack de doble ancho (4OU) entregando 2.9 exaflops de rendimiento de inferencia FP4. AMD afirma que Helios ofrece 15% mejor rendimiento de compute y 50% más capacidad de memoria de alto ancho de banda (HBM4) que NVIDIA Vera Rubin NVL72, ofreciendo 30% más tokens de inferencia por dólar.
Helios tiene un precio entre $5-5.5 millones por rack e entra en producción inmediatamente, con implementaciones de clientes iniciales comenzando en Q4 2026. Los principales clientes anunciados incluyen Microsoft Azure, Meta (1 GW comprometido con Helios), OpenAI (12 GW de GPU AMD en OpenAI y Meta), Oracle, Anthropic (asociación de 2 GW con colaboración de ingeniería para usar Claude para optimización de ROCm) y Tata Consultancy Services. Cada rack proporciona 31 terabytes de memoria HBM4 y 1.7 petabytes/segundo de ancho de banda agregado.
El movimiento de AMD desafía directamente la dominancia de >95% de NVIDIA en el mercado de GPU de centro de datos; AMD actualmente tiene ~4.5%. Helios representa el lanzamiento más integrado de AMD hasta ahora—agrupando silicio, networking y software con asociaciones estratégicas en cargas de trabajo de inferencia (vía Cerebras) y optimización de modelos (vía Anthropic, OpenAI). Para arquitectos que planean infraestructura de IA multivendedor y evalúan el costo total de propiedad a lo largo del tiempo, AMD Helios señala competencia a nivel de rack creble en 2026-2027, con cadenas de suministro ahora diversificándose más allá del monopolio de NVIDIA.
Fuentes
- Primary source
- cnbc.com
“AMD launched Helios, combining 72 MI455X GPUs with EPYC CPUs; CEO Lisa Su claimed 15% better compute than Vera Rubin, 50% more HBM capacity, 30% more tokens/dollar; Microsoft Azure adopting it alongside Meta, OpenAI, Oracle”
- qz.com
“Anthropic partnership to deploy 2 GW of MI455X GPUs; OpenAI bringing Helios online Q4 2026; Microsoft Azure deploying in second half of 2026”
- ir.amd.com
“Helios now in production; 2.9 exaflops FP4, 1.4 exaflops FP8, 31 TB HBM4, 1.7 PB/sec bandwidth; OpenAI and AMD optimizing GPT-class workloads with Triton + ROCm”