Lançamento Estável DeepSeek V4 Transiciona de Prévia; IDs de API Legados se Aposentam em 24 de Julho
DeepSeek anunciou que nomes de modelo de API herdados deepseek-chat e deepseek-reasoner serão totalmente aposentados em 24 de julho de 2026 às 15:59 UTC, completando a transição de V4 Preview (lançada em 24 de abril de 2026) para produção estável. Os dois modelos principais, deepseek-v4-pro (1,6T total / 49B parâmetros ativos) e deepseek-v4-flash (284B total / 13B parâmetros ativos), ambos com contexto de 1M-token, pesos MIT-licenciados no Hugging Face e acesso oficial de API. O V4 Preview introduziu uma arquitetura de Atenção Comprimida Esparsa (CSA) híbrida e Atenção Pesadamente Comprimida (HCA) direcionada para eficiência de inferência; V4-Pro marca 80,6% em SWE-bench Verificado (empatado com Claude Opus 4.6 em 80,8% dentro da margem).
DeepSeek anunciou preços em horário de pico para o lançamento estável V4: custo base 2× durante horas comerciais de Pequim (9-12 e 14-18 UTC+8). As taxas fora do pico permanecem nos níveis de prévia atual. O preço da lista V4-Pro é $1,74 / $3,48 por 1M entrada/saída de tokens, embora um desconto de 75% o tenha trazido a $0.435 / $0.87 até maio de 2026. V4-Flash permanece aproximadamente 1/10 do custo de saída de V3.2 em $0,14 / $0,28. Desenvolvedores que usam os IDs legados descontinuados têm até 24 de julho para migrar; até então, ambos os alias direcionam para V4-Flash em modos de pensamento não-pensamento e pensamento, respectivamente, tornando a migração uma mudança de código de uma única linha.
Para equipes de IA em produção, o lançamento estável marca a formação de V4 de DeepSeek de opcional para status de produção bloqueado. O posicionamento eficiência-primeiro—90% capacidade de fronteira a 40-50% dos custos de API rivais—tem ganho tração enquanto empresas priorizam custo de implantação sobre ganhos de capacidade marginais. V4-Flash tornou-se a espinha dorsal do agente padrão para cargas de trabalho sensíveis a custos; V4-Pro visa tarefas de geração de código e raciocínio onde a escala de parâmetro 1,6T justifica trocas de custo. O prazo de 24 de julho cria uma função de forçamento suave para planejamento de migração, embora integrações existentes continuem a funcionar com IDs legados até o corte.
Fontes
- Primary source
- api-docs.deepseek.com
“deepseek-chat & deepseek-reasoner will be fully retired and inaccessible after Jul 24th, 2026, 15:59 (UTC Time)”
- kie.ai
“V4-Pro at 1.6T total parameters with 49B activated, V4-Flash at 284B total with 13B activated”
- explainx.ai
“The official version of DeepSeek V4 is planned to launch in mid-July with peak-hour pricing mechanism”