Inference platform pra open-weights — preços competitivos, latência boa, fine-tuning managed.
Hosting managed dos principais open-weights (Llama, Qwen, DeepSeek) com pricing competitivo. Fine-tuning + serving num só lugar elimina ops. Trade-off: SLA e governance ainda menos maduros que AWS/GCP pra projetos sensíveis. Pilotar pra projetos não-regulados que querem open-weights sem rodar GPUs.