AMD lançou oficialmente Helios, seu primeiro sistema rack-scale de IA, em Advancing AI 2026 em San Francisco em 23 de julho. O sistema combina 72 GPUs AMD Instinct MI455X com CPUs EPYC Venice de 6ª geração e networking Pensando em um rack de dupla largura (4OU) entregando 2,9 exaflops de desempenho de inferência FP4. AMD afirma que Helios oferece desempenho de compute 15% melhor e 50% maior capacidade de memória de alta largura de banda (HBM4) do que NVIDIA Vera Rubin NVL72, oferecendo 30% mais tokens de inferência por dólar.
Helios é preçado entre $5-5,5 milhões por rack e entra em produção imediatamente, com implementações de clientes iniciais começando em Q4 2026. Grandes clientes anunciados incluem Microsoft Azure, Meta (1 GW comprometido com Helios), OpenAI (12 GW de GPUs AMD em OpenAI e Meta), Oracle, Anthropic (parceria de 2 GW com colaboração de engenharia para usar Claude para otimização ROCm) e Tata Consultancy Services. Cada rack fornece 31 terabytes de memória HBM4 e 1,7 petabytes/segundo de largura de banda agregada.
O movimento de AMD desafia diretamente a dominância de >95% da NVIDIA no mercado de GPU de data center; AMD atualmente possui ~4,5%. Helios representa o lançamento mais integrado da AMD ainda—agrupando silício, networking e software com parcerias estratégicas em cargas de trabalho de inferência (via Cerebras) e otimização de modelos (via Anthropic, OpenAI). Para arquitetos planejando infraestrutura IA multi-fornecedor e avaliando custo total de propriedade ao longo do tempo, AMD Helios sinaliza competição rack-level credível em 2026-2027, com cadeias de suprimentos agora diversificando além do monopólio NVIDIA.