DeepSeek GA'd DeepSeek-V4-Pro-0813 em 13 de agosto após uma fase de prévia de quatro meses, otimizando para tarefas de IA agentic: uso de ferramentas, execução de código e fluxos de trabalho multi-etapas. O modelo alcançou 87,9 em Terminal Bench 2.1, 62,7 em DeepSWE (engenharia de software) e 61,5 em NL2Repo. Suporta contexto de 1M-token com saídas de até 384K-token, modos de think e non-thinking duais e três níveis de esforço configuráveis (low/high/max). O acesso à API está em tempo real; os preços escalam de taxa de $0,87/M output tokens para $3,96/M em horas de pico (16 de agosto), com descontos de 50% fora do pico.
O lançamento de disponibilidade geral marca uma mudança estratégica em relação à prévia de abril, que foi superada pelo próprio modelo mais barato DeepSeek V4-Flash em alguns testes independentes—um resultado incomum que criou momento inicial para Flash. Com o GA 0813, DeepSeek agora está precificando V4-Pro em 14× o custo de output de Flash ($3,96 vs $0,28) enquanto alega melhorias substanciais de agentes em cargas de trabalho de produção. A empresa também anunciou suporte ao formato de API OpenAI, integração Codex e compatibilidade nativa com API de Respostas, posicionando o modelo para fluxos de trabalho agentic empresariais.
Para construtores, a relevância está no roteamento de custo-versus-capacidade: Together AI benchmarked a cascata (execute Pro primeiro, escale para GPT-5.6 Sol em falha de teste) em $3,35 por tarefa resolvida—superando Sol sozinho (72,7% pass@1) por menos da metade do preço por tarefa. Em 1/35 do custo unitário de GPT-5.6 Sol e com cobertura forte de agente agentic em benchmarks abertos (80,6% em SWE-Bench Verified), DeepSeek V4-Pro está forçando um repricing fundamental da economia de coding-agent.