IBM y Together AI firmaron un acuerdo multiaño de $240 millones para desplegar un gran clúster de inferencia en IBM Cloud utilizando sistemas Nvidia HGX B300 (arquitectura Blackwell) emparejados con redes Spectrum-X. El clúster inicial basado en EE.UU. contará con aproximadamente 2.000 chips Blackwell 300 y estará disponible en H1 2027. El CRO de Together AI dijo que la capacidad se 'agotará al menos dos o tres meses antes de tiempo.'
El acuerdo refleja un cambio estructural en la economía de IA de entrenamiento a inferencia: a medida que las empresas mueven la IA de prueba de concepto a producción, la inferencia— el proceso de ejecutar modelos entrenados para generar respuestas— se está convirtiendo en el principal impulsor de la demanda de computación. Together AI actualmente procesa 400 billones de tokens mensualmente y se enfoca en modelos de código abierto (DeepSeek, MiniMax, Kimi) que las empresas ven como más baratos y menos riesgosos que los sistemas cerrados de OpenAI, Anthropic o Meta.
IBM se está posicionando como el intermediario de infraestructura para empresas que buscan IA de código abierto y eficiencia de costos. El acuerdo refleja un escepticismo cibernético creciente hacia modelos cerrados y preocupaciones de residencia de datos, particularmente entre industrias reguladas (bancos, hospitales). Together AI, valorada en $8,3B en julio, representa una apuesta en que la inferencia de código abierto a escala capturará empresas reacias a pagar precios premium por modelos propietarios.