aiexpert
Início / Notícias / Nota
Research · 07 de ago. de 2026, 07:04 · 7 fontes

Meta Muse Spark 1.2 atinge 54 no Índice de Análise Artificial com ganhos de codificação

Meta lançou Muse Spark 1.2 em 5 de agosto de 2026, seu terceiro lançamento de modelo em quatro meses, ao lado de Muse Code, um agente de codificação de terminal lançado em beta. No Índice de Inteligência de Análise Artificial, Muse Spark 1.2 obteve 54, acima do 51 de Muse Spark 1.1 e do 43 original de Muse Spark em abril—um ganho de 11 pontos em quatro meses. O modelo agora empatou com Grok 4.5 da SpaceXAI em 54, posicionando-o logo atrás do cluster de fronteira de Claude Opus 5 (61), Claude Fable 5 (60) e GPT-5.6 Sol (59).

O ganho concentrou-se no desempenho agentic, onde o GDPval-AA v2 Elo do Meta saltou 260 pontos para 1631, colocando-o em quinto lugar entre modelos benchmarked. O preço permanece inalterado em $1,25 por milhão de tokens de entrada e $4,25 por milhão de tokens de saída na API Meta Model; um novo nível de contribuidor oferece desconto de entrada 12,5x e saída 21,25x em troca de direitos de treinamento em dados do usuário. Muse Code, o agente de terminal co-treinado, executa engenharia de software em escala de repositório com agentes de fundo persistentes e subagentes paralelos. Os benchmarks de codificação internos do Meta mostram Muse Spark 1.2 em 82,9% em Terminal-Bench 2.1 e 59,3% em DeepSWE 1.1—segundo apenas Claude Opus 5 nesses testes executados por fornecedor.

Para praticantes, o ritmo importa: quatro semanas entre grandes drops de modelo é um ritmo que apenas Meta mantém agora. No entanto, os ganhos de benchmark vieram com aumento no uso de tokens—tokens de entrada acima de ~53%, saída ~36%—impulsionado pelo raciocínio obrigatório no lançamento. Nenhuma verificação independente de Terminal-Bench existia na publicação, e Meta's 1.1 ficou 3,8 pontos abaixo de sua própria afirmação quando verificado pela equipe de benchmark. Uma janela de contexto de 1M-token e suporte multimodal permanecem inalterados. Muse Code está disponível para macOS e Linux, com suporte a Windows ainda não anunciado.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source artificialanalysis.ai
  2. 02 artificialanalysis.ai artificialanalysis.ai “Muse Spark 1.2 (xhigh) lands at 54, up 3 points from Muse Spark 1.1 (51) and 11 points from Muse Spark 1.0 (43, April).”
  3. 03 datanorth.ai datanorth.ai “Muse Spark 1.2 scores 82.9% on Terminal-Bench 2.1 at unchanged standard API pricing.”
  4. 04 orcarouter.ai orcarouter.ai “The original Muse Spark scored 43 in April. Muse Spark 1.1 reached 51 on July 9, an eight-point gain in a quarter. Muse Spark 1.2 adds three more in under a month.”
  5. 05 vorplabs.com vorplabs.com “Standard-tier API pricing is unchanged from 1.1 at $1.25 input, $0.15 cached input, and $4.25 output per 1M tokens with a 1,048,576-token context. The real pricing story is the new muse-spark-1.2-contributor tier: $0.10 input and $0.20 output, a discount of 12.5x on input and 21.25x on output.”
  6. 06 artificialanalysis.ai artificialanalysis.ai “Its GDPval-AA v2 Elo rose 260 points to 1631, #5 among all models we have benchmarked”
  7. 07 kingy.ai kingy.ai “Meta's previous model came in 3.8 points below its own published figure when the same benchmark was run and verified by the Terminal-Bench team.”