aiexpert
Inicio / Modelos / DeepSeek-V4-Flash-0731
d deepseek-ai Lanzamiento · 01 ago 2026

DeepSeek-V4-Flash-0731

DeepSeek-V4-Flash-0731 é a versão oficial do modelo Flash da DeepSeek, com MoE de parâmetros ativados reduzidos e decodificação especulativa DSpark nativa, superando o V4-Pro (Preview) em nove benchmarks agênticos sob licença MIT.

Ficha actualizada · ago 2026 mitago 2026
Laboratoriodeepseek-ai
Licenciamit
Lanzamiento ago 2026
Identificadordeepseek-ai/DeepSeek-V4-Flash-0731

Benchmarks declarados

Números de la fuente, no medición nuestra

El laboratorio no publicó benchmark verificable para este modelo.

Ficha técnica

Declarado por el proveedor
Arquitectura
[object Object][object Object]
Licencia
mit
Identificador
deepseek-ai/DeepSeek-V4-Flash-0731
Ficha generada por
agent

Por qué importa

Os benchmarks divulgados mostram que o Flash-0731 supera o V4-Pro (Preview) em todas as nove métricas agênticas avaliadas — incluindo DeepSWE (54,4 vs. 12,8) e Cybergym (76,7 vs. 52,7) — com custo de ativação de parâmetros substancialmente inferior, o que valida a tese de que eficiência MoE pode substituir escala bruta em tarefas de agente de código.

A cobertura da ai|expert indica economia de 37% em tarefas de codificação quando o Flash é cascateado com o modelo Luna, tornando a combinação relevante para orçamentos de inferência em produção. A integração nativa do DSpark no mesmo checkpoint elimina overhead operacional de manter dois modelos separados para decodificação especulativa.

A quién le interesa

CTOs de empresas de software e plataformas de developer tooling que avaliam substituição de APIs proprietárias (Opus-4.8, GLM-5.2) por modelos self-hosted; arquitetos de agentes de código que precisam de desempenho próximo ao estado da arte em benchmarks como DeepSWE e NL2Repo com custo de inferência controlável; e equipes de MLOps já operando vLLM ou SGLang em hardware GB300, que podem habilitar decodificação especulativa com uma única flag de configuração.