Majestic Labs, uma startup de infraestrutura furtiva, fechou uma rodada de financiamento de $100 milhões para desenvolver arquitetura de servidor de pooling de memória para cargas de trabalho de IA. O financiamento visa um gargalo crítico de infraestrutura: fragmentação de memória GPU em implementações multi-modelo onde GPUs separadas desperdiçam capacidade ao executar trabalhos de inferência intensiva com lotes pequenos.
Para operadores de data center e equipes de infraestrutura de IA, o pooling de memória promete ganhos significativos de TCO aumentando a utilização de GPU em cargas de trabalho de inferência—um jogo direto em otimização de custos conforme a adoção de IA escala e a economia por token se torna o driver de margem para provedores de modelos de fundação.