A AMD chegou a um acordo definitivo para adquirir a Taalas, uma startup de Toronto que projeta chips de inferência de IA customizados ao embutir pesos de modelos diretamente no silício. Fundada em 2023, a Taalas levantou $219 milhões em financiamento de venture capital e construiu uma plataforma que transforma modelos de IA em hardware dedicado, alcançando até 17.000 tokens por segundo no modelo Llama 3.1 8B da Meta de acordo com demonstrações iniciais. A AMD não divulgou o preço de aquisição.
A inovação central da Taalas são circuitos integrados específicos para modelo (ASICs) que otimizam fluxos de dados de inferência e reduzem gargalos de computação e memória em comparação com GPUs de propósito geral. A desvantagem é flexibilidade: cada chip Taalas executa um único modelo, embora a empresa afirme que apenas dois de 100+ camadas de silício precisam mudar entre designs, possibilitando tape-outs de aproximadamente dois meses. A AMD planeja integrar a tecnologia Taalas em seus sistemas Helios de escala de rack, emparelhando aceleradores de inferência customizados com GPUs Instinct para uma arquitetura desagregada onde processamento de prompt é feito em GPUs e geração de token é descarregada para chips Taalas.
O acordo posiciona a AMD para desafiar diretamente a Nvidia no mercado de acelerador de IA. Enquanto Nvidia domina com GPUs flexíveis apoiadas por CUDA, Nvidia também licenciou tecnologia de inferência da Groq em um acordo de $20 bilhões em dezembro de 2025. A CEO da AMD Lisa Su sinalizou abertura para chips especializados junto com GPUs, enquadrando o futuro como 'não há solução única para todos.' O chip de segunda geração HC2 da Taalas apunta para modelos de 20 bilhões de parâmetros; escalar para inferência de trilhão de parâmetro exigiria aproximadamente 50 aceleradores customizados versus centenas de GPUs.
Para arquitetos entregando inferência em escala, esta aquisição sinaliza o pivô da indústria de silício de propósito geral para especializado. ASICs específicos de modelo são apenas economicamente viáveis se o volume de deploymente justifica tape-outs customizados; a capacidade de integração de credibilidade e sistema da AMD torna viável o modelo da Taalas onde startups independentes enfrentavam atrito de adoção de cliente. O acordo fecha em Q4 de 2026 sujeito a aprovação regulatória.