Meta Superintelligence Labs lançou Muse Spark 1.2 e Muse Code (beta) em 5 de agosto de 2026. Muse Spark 1.2 é um modelo de raciocínio explicitamente co-treinado com Muse Code, agente de terminal de codificação da Meta. Meta alega 82.9% em Terminal-Bench 2.1 e 59% em DeepSWE 1.1. Avaliadores independentes (Artificial Analysis, Vals) comparam Muse Spark 1.2 em 54 no Índice de Inteligência, amarrado com Grok 4.5 e 6–07 pontos atrás de modelos frontier (Claude Opus 5: 61, Claude Fable 5: 60, GPT-5.6 Sol: 59). Vals relata $0,69/teste em Terminal-Bench usando Terminus 2 (harness comum)—o custo mais baixo entre seus modelos top-five. Preço: $1,25 input / $4,25 output por milhão de tokens; tier Contributor em $0,10/$0,20 para permissão de uso de dados.
Muse Code implementa quatro tipos de agente (Coordinator, Explorer, Executor, Verifier) se comunicando através de um log de eventos compartilhado que sobrevive a reinicíos sem re-derivar contexto. O agente terminal suporta trabalhos de 24–30+ horas (vs chamadas de API típicas de 10–15 min), agentes assincrônos de fundo persistentes e isolação Git-worktree. Benchmark de codificação interna da Meta mostra Muse Spark 1.2 em 70.6%, atrás de Claude Opus 5 (79.4%), mas à frente de GPT-5.6 Terra (65.4%). Advertência: o 82.9% é do próprio harness da Meta; Terminal-Bench independente ainda não tem entrada verificada; a alegacão de Muse Spark 1.1 de 80% chegou a 76.2% verificada, uma lacuna de 3.8 pontos.
Para profissionais avaliando codificação de horizonte longo: a segurança de restart do log de eventos de Muse Code e agentes assincrões paralelos são novos para uma oferta de lado de modelo aberto. Custo por tarefa importa se você executa alto volume; Vals' $0,69 fica abaixo de GPT-5.6 e Claude. Meta mostrou confiança publicando gráficos onde Claude Opus 5 vence—incomum para um lançamento de fornecedor. Observe se o prêmio co-training (modelo + harness) é mantido em outros frameworks; se não, Muse Spark 1.2 sozinho é tier-2 em raciocínio mas competitivo em preço.