aiexpert
Início / Notícias / Nota
Breaking · 10 de ago. de 2026, 14:38 · 4 fontes

Qwen3.8-Max atinge 86.1 no OSWorld; pesos abertos para flagship e 27B esperado esta semana

Alibaba lançou Qwen3.8-Max em 3 de agosto de 2026—um MoE esparso de 2.4 trilhões de parâmetros com 95B parâmetros ativos, entrada nativa de texto+imagem+vídeo e uma janela de contexto de 1M tokens. A API flagship foi ao vivo no QwenCloud ($2/$6 por milhão de tokens entrada/saída, igualando preços de GPT-5.6 Sol) e está disponível através do Vercel AI Gateway e OpenRouter. Criticamente, Alibaba se comprometeu a lançar pesos abertos para Qwen3.8-Max e um novo Qwen3.8-27B durante a semana de 10 de agosto—a primeira vez que Alibaba ever open-sourced um modelo de classe Max, e sem uma licença divulgada ainda.

Em tarefas agenticas, Qwen3.8-Max lidera as fronteiras proprietárias: marca 86.1 no OSWorld-Verified (superando GPT-5.6 Sol Max em 83.2 e Claude Fable 5 em 85.0), 93.0 no PaperBench e 86.6 no Terminal-Bench 2.1. A codificação é mais apertada: posta 67.7 no SWE-bench Pro (atrás da Fable 5's 80.0 e Opus 4.8's 69.2), mas a lacuna é mais estreita do que gerações anteriores do Qwen. No GPQA Diamond (razão de ciência), empatou Fable 5 em 92.6. Posicionamentos da Arena mostram #4 em Frontend Code (1,668 Elo) e #2 em Vision (1,305), confirmando desempenho competitivo do mundo real. As especificações do variante 27B são não confirmadas, mas testes de terceiros hinting às vezes sugerem capacidade de classe 70B em cargas de trabalho agenticas.

Para arquitetos: o compromisso de peso aberto do Qwen3.8-Max é a ruptura estrutural. Se Max e 27B aterrarem no Hugging Face esta semana com licenciamento Apache 2.0 (ou equivalente), você adquire um flagship de 2.4T e um modelo local prático de 27B na mesma versão, eliminando a troca open-source-vs-frontier-capability que definiu 2026. A paridade de API $2/$6 com fronteiras proprietárias mais pesos abertos redefine a estrutura de custo para frotas de agente auto-hospedadas. Observe o texto de licença no dia do drop—isso determina a liberdade de implantação.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source digitalapplied.com
  2. 02 yottalabs.ai yottalabs.ai “Alibaba previewed Qwen 3.8-Max on July 19, 2026, at the World AI Conference in Shanghai, then released it officially on August 3, 2026. At launch Alibaba committed to releasing open weights within about a week, for both Qwen 3.8-Max and a smaller Qwen3.8-27B.”
  3. 03 datacamp.com datacamp.com “Qwen3.8-Max scales to 2.4 trillion parameters and posts 86.1 on OSWorld-Verified, ahead of GPT-5.6 Sol Max at 83.2, Claude Fable 5 at 85.0. The open weights arrive next week alongside a smaller Qwen3.8-27B.”
  4. 04 finance.yahoo.com finance.yahoo.com “By launching the API first and committing to release open weights around August 10, Alibaba is cannibalizing its own commercial offering to force a rapid commoditization of high-end intelligence.”