IBM e Together AI assinaram um acordo multianual de $240 milhões para implantar um grande cluster de inferência no IBM Cloud usando sistemas Nvidia HGX B300 (arquitetura Blackwell) emparelhados com rede Spectrum-X. O cluster inicial baseado em EUA apresentará aproximadamente 2.000 chips Blackwell 300 e estará disponível em H1 2027. O CRO de Together AI disse que a capacidade irá 'vender no mínimo dois a três meses antes do tempo.'
O acordo reflete uma mudança estrutural na economia de IA de treinamento para inferência: quando as empresas movem a IA de prova de conceito para produção, a inferência— o processo de executar modelos treinados para gerar respostas— está se tornando o principal impulsionador da demanda de computação. Together AI atualmente processa 400 trilhões de tokens mensalmente e se concentra em modelos de código aberto (DeepSeek, MiniMax, Kimi) que as empresas veem como mais baratos e menos arriscados do que sistemas fechados da OpenAI, Anthropic ou Meta.
IBM está se posicionando como o intermediário de infraestrutura para empresas que buscam IA de código aberto e eficiência de custos. O acordo reflete ceticismo de segurança cibernética crescente em relação aos modelos fechados e preocupações de residência de dados, particularmente entre indústrias reguladas (bancos, hospitais). Together AI, avaliada em $8,3B em julho, representa uma aposta em que a inferência de código aberto em escala capturará empresas relutantes em pagar preços premium por modelos proprietários.