AMD anunciou um acordo definitivo para adquirir Taalas, uma startup de chips de IA baseada em Toronto que codifica pesos de modelos diretamente no silício para eficiência extrema de inferência. Os termos não foram divulgados, mas Taalas arrecadou $219 milhões desde sua fundação em 2023 e conta com Quiet Capital, Fidelity e o investidor de semicondutores Pierre Lamond como apoiadores. O acordo deve ser encerrado em Q4 2026 sujeito à aprovação regulatória.
A abordagem de Taalas troca flexibilidade por velocidade: seu chip HC1 atinge quase 17.000 tokens por segundo em Llama3.1-8B—73 vezes mais rápido que o H200 da Nvidia com um décimo da potência—mas executa apenas esse modelo único. A empresa visa fazer o tape-out de novos chips específicos para modelos em aproximadamente dois meses usando ferramentas proprietárias. HC2 de segunda geração visa 20 bilhões de parâmetros; modelos maiores exigiriam vários chips via paralelismo de pipeline.
AMD planeja integrar a tecnologia Taalas em seus sistemas Helios rack-scale ao lado de GPUs Instinct e CPUs EPYC, espelhando o acordo de licenciamento Groq de $20 bilhões da Nvidia de dezembro de 2025. Para arquitetos, isso sinaliza a aposta da AMD de que cargas de trabalho de inferência cada vez mais exigem silício especializado ao lado de aceleradores de uso geral—uma mudança longe da inferência de GPU de tamanho único que reformula o design de sistema e o planejamento de capex para cargas de trabalho pesadas em implantação.