DeepSeek V4-Flash 0731 sale de vista previa con puntuación de inteligencia 50, 60% más barato que GPT-5.6 Luna
DeepSeek lanzó oficialmente V4-Flash 0731 el 31 de julio de 2026, moviendo el modelo del estado de vista previa a disponibilidad de nivel de producción. El modelo Mixture of Experts de 284 mil millones de parámetros (13B activos) logró una puntuación del Artificial Analysis Intelligence Index de 50—un salto de 10 puntos sobre la vista previa de abril y solo 1 punto por debajo del recién descuento GPT-5.6 Luna de OpenAI (51 en máximo esfuerzo). La actualización vino solo a través de post-entrenamiento, sin cambios arquitectónicos, y el modelo llega con soporte de integración Codex y el módulo de decodificación especulativa DSpark integrado.
En la API de DeepSeek, V4-Flash 0731 cuesta $0,14 por millón de tokens de entrada y $0,28 por millón de tokens de salida, con descuento de caché agresivo del 98% a $0,0028 en tokens en caché. Contabilizando las tasas típicas de acierto de caché (proporción 7:2:1 de caché/entrada/salida), el costo combinado cae a $0,06 por millón de tokens. Artificial Analysis calcula el costo por tarea del modelo aproximadamente 60% más barato que Luna a pesar de coincidir con la inteligencia en puntos de referencia de agentes de codificación. El modelo tiene licencia MIT y está disponible en Hugging Face (aunque los pesos 0731 aún no se han publicado; la versión actual sigue siendo la vista previa de abril), ejecutable localmente a 168GB para 4-bit sin pérdidas o 110GB para cuantización 3-bit.
Para constructores y equipos de infraestructura, la secuencia importa: DeepSeek eligió productivizar Flash (la capa de bajo costo) primero mientras mantenía V4-Pro (flagship de 1,6T) en vista previa. Esto invierte el marco clásico "más grande es mejor" y señala que la calidad de post-entrenamiento y la compatibilidad de arnés ahora superan la cantidad de parámetros para cargas de trabajo agénicas empresariales. El lanzamiento de Flash 0731 llega un día después de los cortes de precios de Luna de OpenAI, remoldando nuevamente la curva de precio-rendimiento y continuando el patrón de modelos chinos estableciendo el ritmo en costo mientras que los laboratorios frontier compiten en velocidad y confiabilidad.
Fuentes
- Primary source
- DeepSeek V4 Flash 0731: Official Release, Agent Benchmarks
“284B/13B MoE, same architecture re-post-trained, MIT-licensed, Artificial Analysis scores 50 on Intelligence Index”
- DeepSeek API Changelog
“DeepSeek-V4-Flash API now in public beta with Codex support and significantly enhanced agent capabilities”
- Artificial Analysis: DeepSeek V4 Flash 0731
“Cost per task 60% lower than Luna at matching intelligence; $0.06 blended rate on 7:2:1 cache/input/output ratio”