aiexpert
Inicio / Noticias / Nota
Market · 10 ago 2026, 15:04 · 4 fuentes

DeepSeek V4-Flash cuesta 67% menos que V4-Pro en output; ~79% de calidad de codificación a 1/3 del precio

El alineamiento de dos niveles V4 de DeepSeek de finales de julio de 2026 agudiza el compromiso costo-calidad. V4-Flash ($0.14 entrada / $0.28 salida por 1M tokens) se posiciona como el caballo de tiro de alto volumen, mientras que V4-Pro ($0.435 entrada / $0.87 salida por 1M tokens) se dirige al razonamiento y codificación más difícil. En tokens de salida, Flash cuesta aproximadamente 68% menos que Pro, o alrededor de 12.4× más barato por unidad. La distinción importa porque la mayoría de los desarrolladores pagan por salida, no entrada, cuando el contexto ya está cargado.

En evaluaciones estándar de ingeniería de software, V4-Flash logra ~79% en SWE-bench Verified (resolviendo problemas reales de GitHub) versus ~80.6% para Pro. La actualización posterior al entrenamiento -0731 ajustó específicamente Flash para tareas agenticas: Terminal-Bench 2.1 en 82.7, Toolathlon Verified en 70.3 y DeepSWE en 54.4 — competitivo con modelos de código cerrado mucho más grandes. DeepSeek señaló la actualización como un refinamiento posterior al entrenamiento, no una nueva arquitectura, y mantuvo estable el nombre del modelo (deepseek-v4-flash) para que las integraciones existentes obtengan la mejora automáticamente.

En comparación con modelos de frontera occidental, Flash sigue siendo 95% más barato en entrada y 98% más barato en salida versus Claude Sonnet 4.6, y 85% más barato que el propio V4-Pro por token. La fijación de precios de cache-hit cae la entrada Flash a $0.003 por 1M, haciendo que las cargas de trabajo de prefijo repetido sean casi gratuitas después de la primera pasada. DeepSeek anunció un futuro aumento de precio (fecha efectiva y magnitud por confirmar), pero el rate card actual se mantiene.

Para equipos de ingeniería que construyen sistemas agenticos de alto volumen, RAG de documentos largos o asistentes de codificación, el bajo costo de salida de V4-Flash y la capacidad de razonamiento suficiente invierten la ecuación lejos de la consolidación de modelo único hacia enrutamiento inteligente: V4-Flash por defecto, modo razonamiento Flash@max para la mayoría del trabajo, y escalada Pro solo para la minoría más difícil. Esa estrategia de enrutamiento típicamente reduce facturas 60-80% manteniendo calidad en 95% de las tareas.

Fuentes

Todo lo que sostiene esta nota
  1. 01 Primary source deepseek.ai
  2. 02 DeepSeek API Pricing 2026: V4-Flash & V4-Pro Per-Token Costs deepseek.ai “V4-Flash $0.14/$0.28; V4-Pro $0.435/$0.87 per 1M tokens”
  3. 03 DeepSeek V4 Pro vs DeepSeek V4 Flash: Performance, Pricing, and When to Use Each codersera.com “Flash@max roughly matches Pro@high on reasoning while costing about 12.4x less per output token”
  4. 04 DeepSeek V4 Flash vs V4 Pro: Efficiency vs Flagship orcarouter.ai “aggregator evaluations put V4 Flash (Max) around 79.0% on SWE-bench Verified versus about 80.6% for V4 Pro”