AMD lança Helios rack; 15% mais compute, 30% melhor tokens/dólar que Vera Rubin
AMD lançou oficialmente Helios, seu primeiro sistema rack-scale de IA, em Advancing AI 2026 em San Francisco em 23 de julho. O sistema combina 72 GPUs AMD Instinct MI455X com CPUs EPYC Venice de 6ª geração e networking Pensando em um rack de dupla largura (4OU) entregando 2,9 exaflops de desempenho de inferência FP4. AMD afirma que Helios oferece desempenho de compute 15% melhor e 50% maior capacidade de memória de alta largura de banda (HBM4) do que NVIDIA Vera Rubin NVL72, oferecendo 30% mais tokens de inferência por dólar.
Helios é preçado entre $5-5,5 milhões por rack e entra em produção imediatamente, com implementações de clientes iniciais começando em Q4 2026. Grandes clientes anunciados incluem Microsoft Azure, Meta (1 GW comprometido com Helios), OpenAI (12 GW de GPUs AMD em OpenAI e Meta), Oracle, Anthropic (parceria de 2 GW com colaboração de engenharia para usar Claude para otimização ROCm) e Tata Consultancy Services. Cada rack fornece 31 terabytes de memória HBM4 e 1,7 petabytes/segundo de largura de banda agregada.
O movimento de AMD desafia diretamente a dominância de >95% da NVIDIA no mercado de GPU de data center; AMD atualmente possui ~4,5%. Helios representa o lançamento mais integrado da AMD ainda—agrupando silício, networking e software com parcerias estratégicas em cargas de trabalho de inferência (via Cerebras) e otimização de modelos (via Anthropic, OpenAI). Para arquitetos planejando infraestrutura IA multi-fornecedor e avaliando custo total de propriedade ao longo do tempo, AMD Helios sinaliza competição rack-level credível em 2026-2027, com cadeias de suprimentos agora diversificando além do monopólio NVIDIA.
Fontes
- Primary source
- cnbc.com
“AMD launched Helios, combining 72 MI455X GPUs with EPYC CPUs; CEO Lisa Su claimed 15% better compute than Vera Rubin, 50% more HBM capacity, 30% more tokens/dollar; Microsoft Azure adopting it alongside Meta, OpenAI, Oracle”
- qz.com
“Anthropic partnership to deploy 2 GW of MI455X GPUs; OpenAI bringing Helios online Q4 2026; Microsoft Azure deploying in second half of 2026”
- ir.amd.com
“Helios now in production; 2.9 exaflops FP4, 1.4 exaflops FP8, 31 TB HBM4, 1.7 PB/sec bandwidth; OpenAI and AMD optimizing GPT-class workloads with Triton + ROCm”