OpenAI sintonizou GPT-5.6 Sol especificamente para conver sas de ChatGPT, melhorando acurácia fatual e foco de resposta. Avaliação interna mostra respostas com pelo menos um erro fatual foram 68% menos comuns com Sol em comparação com GPT-5.5 Instant. Usuários Plus e Pro agora têm um slider para controlar esforço de raciocínio por resposta, substituindo interfaces Instant e Thinking separadas. Para usuários Free, Luna agora é o modelo padrão com chats de texto ilimitado e novo botão Think para perguntas exigindo raciocínio mais profundo.
Em 30 de julho, OpenAI cortou preços significativamente: GPT-5.6 Luna caiu 80% e GPT-5.6 Terra caiu 20%. Sol Fast mode (na API) fornece até 2,5x velocidade de processamento Standard a 2x preço Standard. Luna agora custa 80% menos mas é performance-equivalente a modelos que eram frontier-class um ano atrás; Terra permanece competitivo com GPT-5.5 a 40% custo de token de Sol. OpenAI creditou trabalho de otimização do próprio Sol: Sol ajudou reduzir custos de serviço end-to-end em 20% e melhorou eficiência de decodificação especulativa em 15%.
Essas otimizações estão sendo passadas a todos os usuários—API, Codex e ChatGPT. Auto-review em ChatGPT e Codex CLI aprimorado de GPT-5.4 para Luna, esperado custar ~10x menos. Tanto Luna quanto Terra suportam ferramentas e fluxos de trabalho multi-passo, tornando aplicações de alto volume em escala mais cost-effective. Capacidades de modelo permanecem inalteradas; o solver é apenas mais barato de executar.
Para arquitetos: corte de 80% de Luna muda lógica de roteamento padrão para deployments cost-conscious. Avalie se tarefas atualmente em Sol ou Terra podem cair para Luna com qualidade equivalente; teste A/B a mudança. Slider de raciocínio pode desbloquear novos padrões de UX para chat de usuário (respostas de latência variável baseada em complexidade de pergunta). Observe se outros labs frontier combinam preço de Luna; se não, lacuna de custo-por-capacidade se amplia significativamente.