AMD lanzó oficialmente el Instinct MI455X, su GPU de centro de datos CDNA 5 diseñada para entrenamiento e inferencia de IA de frontera, en su evento Advancing AI 2026 a finales de julio. El acelerador empaqueta 432GB de memoria HBM4 (50% más que NVIDIA Rubin a 288GB) con ancho de banda de memoria de 23,3 TB/s, 40 PFLOPS de computación FP4 y 320 mil millones de transistores en un diseño chiplet de 2nm/3nm. El MI455X alimenta el sistema Helios a escala de rack, que agrega 72 GPUs en un dominio unificado que entrega 2,9 exaFLOPS en FP4 y 31 TB de memoria HBM4 compartida a 1,67 PB/s de ancho de banda agregado. AMD posicionó explícitamente el acelerador como competidor directo del NVL72 GB300 de NVIDIA y de las plataformas Vera Rubin de próxima generación.
El MI455X utiliza empaque CoWoS-L avanzado de TSMC con cuatro Accelerator Complex Dies (8 XCDs totales) en 2nm unidos a dos Fabric/Cache Dies en 3nm, cada uno conectado a seis pilas HBM4 a través de una interfaz de memoria de 2048 bits. CDNA 5 realiza cambios arquitectónicos significativos: descarta el modelo de computación Wave64 nativo para Wave32 (latencia más baja para agentes), añade caché L2 local de 96MB por die, introduce un Tensor Data Mover para transferencias GPU-memoria, y soporta hasta ocho particiones espaciales vía NUMA. El rack Helios utiliza estándares abiertos—OCP, UALink sobre Ethernet y UEC—en lugar de interconexiones propietarias, y conecta vía ancho de banda scale-up de 260TB/s y 43TB/s scale-out.
Para arquitectos: la ventaja de capacidad de memoria del 50% del MI455X sobre Rubin importa más para inferencia de contexto largo y almacenamiento en caché KV de lote grande donde permanecer residente en memoria GPU ahorró overhead de comunicación. Las brechas de benchmark permanecen: AMD reclama 15% más alto que Rubin en pruebas internas, pero el desempeño del mundo real depende de la madurez de optimización ROCm y estrategias de cuantización que aún no han sido validadas de forma independiente. Se esperan despliegues de volumen Helios en H2 2026. La apuesta del ecosistema es significativa: AMD se está comprometiendo con lanzamientos de acelerador anuales (MI500 en 2027, MI600 en 2028), señalando un ritmo competitivo más rápido que el ritmo histórico de NVIDIA. Para equipos que construyen infraestructura de inferencia nativa en la nube, la apuesta en estándares abiertos en UALink y herramientas OCP puede reducir el riesgo de bloqueo de NVIDIA.