aiexpert
Inicio / Noticias / Nota
Chips · 10 ago 2026, 07:32 · 6 fuentes

AMD Instinct MI455X se envía con 432GB HBM4, 40 PFLOPs FP4, rivaliza NVIDIA Rubin en plataforma Helios a escala de rack

AMD lanzó oficialmente el Instinct MI455X, su GPU de centro de datos CDNA 5 diseñada para entrenamiento e inferencia de IA de frontera, en su evento Advancing AI 2026 a finales de julio. El acelerador empaqueta 432GB de memoria HBM4 (50% más que NVIDIA Rubin a 288GB) con ancho de banda de memoria de 23,3 TB/s, 40 PFLOPS de computación FP4 y 320 mil millones de transistores en un diseño chiplet de 2nm/3nm. El MI455X alimenta el sistema Helios a escala de rack, que agrega 72 GPUs en un dominio unificado que entrega 2,9 exaFLOPS en FP4 y 31 TB de memoria HBM4 compartida a 1,67 PB/s de ancho de banda agregado. AMD posicionó explícitamente el acelerador como competidor directo del NVL72 GB300 de NVIDIA y de las plataformas Vera Rubin de próxima generación.

El MI455X utiliza empaque CoWoS-L avanzado de TSMC con cuatro Accelerator Complex Dies (8 XCDs totales) en 2nm unidos a dos Fabric/Cache Dies en 3nm, cada uno conectado a seis pilas HBM4 a través de una interfaz de memoria de 2048 bits. CDNA 5 realiza cambios arquitectónicos significativos: descarta el modelo de computación Wave64 nativo para Wave32 (latencia más baja para agentes), añade caché L2 local de 96MB por die, introduce un Tensor Data Mover para transferencias GPU-memoria, y soporta hasta ocho particiones espaciales vía NUMA. El rack Helios utiliza estándares abiertos—OCP, UALink sobre Ethernet y UEC—en lugar de interconexiones propietarias, y conecta vía ancho de banda scale-up de 260TB/s y 43TB/s scale-out.

Para arquitectos: la ventaja de capacidad de memoria del 50% del MI455X sobre Rubin importa más para inferencia de contexto largo y almacenamiento en caché KV de lote grande donde permanecer residente en memoria GPU ahorró overhead de comunicación. Las brechas de benchmark permanecen: AMD reclama 15% más alto que Rubin en pruebas internas, pero el desempeño del mundo real depende de la madurez de optimización ROCm y estrategias de cuantización que aún no han sido validadas de forma independiente. Se esperan despliegues de volumen Helios en H2 2026. La apuesta del ecosistema es significativa: AMD se está comprometiendo con lanzamientos de acelerador anuales (MI500 en 2027, MI600 en 2028), señalando un ritmo competitivo más rápido que el ritmo histórico de NVIDIA. Para equipos que construyen infraestructura de inferencia nativa en la nube, la apuesta en estándares abiertos en UALink y herramientas OCP puede reducir el riesgo de bloqueo de NVIDIA.

Fuentes

Todo lo que sostiene esta nota
  1. 01 Primary source hothardware.com
  2. 02 AMD Ships Helios AI Rack With EPYC 9006 CPUs, Instinct MI400X GPUs hothardware.com “The MI455X moves to the CDNA 5 architecture which seems to be quite a radical departure from the previous generation.”
  3. 03 AMD Instinct MI455X GPU features 432GB HBM4 and 23.3 TB/s memory bandwidth videocardz.com “The accelerator includes 432GB of HBM4 memory and offers up to 23.3 TB/s of peak memory bandwidth. AMD lists 320 billion transistors and a 2nm process node.”
  4. 04 xenospectrum.com xenospectrum.com “Helios repeatedly arranges compute trays, each loaded with four MI455X units, to fit 72 GPUs into a single rack. The host uses the 6th-generation EPYC Venice.”
  5. 05 tomshardware.com tomshardware.com “All told, the MI455X is AMD's most compelling Instinct product yet. It delivers a massive generational performance improvement.”
  6. 06 chipsandcheese.com chipsandcheese.com “It is AMD's first GPU designed for rack-scale AI deployments and is based on the new CDNA5 architecture with major changes to the compute unit and SoC.”