Alibaba lanzó Qwen3.8-Max el 3 de agosto de 2026—un MoE disperso de 2.4 billones de parámetros con 95B parámetros activos, entrada nativa de texto+imagen+video y una ventana de contexto de 1M tokens. La API principal lanzó en QwenCloud ($2/$6 por millón de tokens entrada/salida, igualando precios de GPT-5.6 Sol) y está disponible a través de Vercel AI Gateway y OpenRouter. Críticamente, Alibaba se comprometió a lanzar pesos abiertos para Qwen3.8-Max y un nuevo Qwen3.8-27B durante la semana del 10 de agosto—la primera vez que Alibaba ha abierto un modelo de clase Max, y sin una licencia divulgada aún.
En tareas agenticas, Qwen3.8-Max lidera las fronteras propietarias: obtiene 86.1 en OSWorld-Verified (superando GPT-5.6 Sol Max a 83.2 y Claude Fable 5 a 85.0), 93.0 en PaperBench y 86.6 en Terminal-Bench 2.1. La codificación es más ajustada: obtiene 67.7 en SWE-bench Pro (detrás de Fable 5 en 80.0 y Opus 4.8 en 69.2), pero la brecha es más estrecha que las generaciones anteriores de Qwen. En GPQA Diamond (razonamiento científico), empatado Fable 5 en 92.6. Las posiciones de Arena muestran #4 en Frontend Code (1,668 Elo) y #2 en Vision (1,305), confirmando rendimiento competitivo del mundo real. Las especificaciones del variante 27B no son confirmadas pero las pruebas de terceros sugieren capacidad de clase 70B en cargas de trabajo agenticas.
Para los arquitectos: el compromiso de peso abierto de Qwen3.8-Max es el quiebre estructural. Si Max y 27B caen en Hugging Face esta semana con licencia Apache 2.0 (o equivalente), adquiere un flagship de 2.4T y un modelo local práctico de 27B en el mismo lanzamiento, eliminando el intercambio open-source-vs-frontier-capability que ha definido 2026. La paridad de API $2/$6 con fronteras propietarias más pesos abiertos redefine la estructura de costos para flotas de agentes auto-hospedadas. Observe el texto de licencia el día del lanzamiento—eso determina la libertad de despliegue.