AMD ha llegado a un acuerdo definitivo para adquirir Taalas, una startup de Toronto que diseña chips de inferencia de IA personalizados mediante la integración de pesos de modelos directamente en silicio. Fundada en 2023, Taalas ha recaudado $219 millones en financiamiento de capital riesgo y construyó una plataforma que transforma modelos de IA en hardware dedicado, logrando hasta 17.000 tokens por segundo en el modelo Llama 3.1 8B de Meta según demostraciones iniciales. AMD no divulgó el precio de adquisición.
La innovación central de Taalas son circuitos integrados específicos para modelo (ASIC) que optimizan flujos de datos de inferencia y reducen cuellos de botella de computación y memoria en comparación con GPU de propósito general. La desventaja es flexibilidad: cada chip Taalas ejecuta un único modelo, aunque la empresa afirma que solo dos de 100+ capas de silicio necesitan cambiar entre diseños, permitiendo tape-outs de aproximadamente dos meses. AMD planea integrar la tecnología Taalas en sus sistemas Helios a escala de rack, emparejando acelerador de inferencia personalizados con GPU Instinct para una arquitectura desagregada donde el procesamiento de indicaciones se realiza en GPU y la generación de tokens se descarga a chips Taalas.
El acuerdo posiciona a AMD para desafiar directamente a Nvidia en el mercado de aceleradores de IA. Si bien Nvidia domina con GPU flexibles respaldadas por CUDA, Nvidia también licenció tecnología de inferencia de Groq en un acuerdo de $20 mil millones en diciembre de 2025. La CEO de AMD Lisa Su ha señalado apertura a chips especializados junto con GPU, enmarcando el futuro como 'no hay una solución única para todos.' El chip de segunda generación HC2 de Taalas apunta a modelos de 20 mil millones de parámetros; escalar a inferencia de un billón de parámetros requeriría aproximadamente 50 aceleradores personalizados versus cientos de GPU.
Para arquitectos que ejecutan inferencia a escala, esta adquisición señala el cambio de la industria de silicio de propósito general a especializado. Los ASIC específicos de modelo solo son económicamente viables si el volumen de implementación justifica tape-outs personalizados; la capacidad de integración de credibilidad y sistema de AMD hace viable el modelo de Taalas donde las startups independientes enfrentaban fricción de adopción de clientes. El acuerdo cierra en Q4 2026 sujeto a aprobación regulatoria.