Lanzamiento Estable DeepSeek V4 Transiciona de Vista Previa; IDs de API Heredados se Retiran el 24 de Julio
DeepSeek anunció que los nombres de modelo API heredados deepseek-chat y deepseek-reasoner se retirarán completamente el 24 de julio de 2026 a las 15:59 UTC, completando la transición de V4 Preview (lanzado el 24 de abril de 2026) a producción estable. Los dos modelos principales, deepseek-v4-pro (1.6T total / 49B parámetros activos) y deepseek-v4-flash (284B total / 13B parámetros activos), ambos con contexto de token de 1M, pesos con licencia MIT en Hugging Face y acceso oficial de API. La V4 Preview introdujo una arquitectura de Atención Dispersa Comprimida (CSA) híbrida y Atención Pesadamente Comprimida (HCA) dirigida a eficiencia de inferencia; V4-Pro obtiene 80.6% en SWE-bench Verificado (empatado con Claude Opus 4.6 al 80.8% dentro del margen).
DeepSeek anunció precios en horas pico para el lanzamiento estable V4: costo base 2× durante horas comerciales de Pekín (9-12 y 14-18 UTC+8). Las tarifas fuera de pico permanecen en los niveles de vista previa actuales. El precio de lista de V4-Pro es $1.74 / $3.48 por entrada/salida de 1M tokens, aunque un descuento del 75% lo llevó a $0.435 / $0.87 hasta mayo de 2026. V4-Flash sigue siendo aproximadamente 1/10 del costo de salida de V3.2 a $0.14 / $0.28. Los desarrolladores que usan los IDs heredados descontinuados tienen hasta el 24 de julio para migrar; hasta entonces, ambos alias se enrutan a V4-Flash en modos de no pensamiento y pensamiento respectivamente, haciendo que la migración sea un cambio de código de una línea.
Para equipos de IA en producción, el lanzamiento estable marca la graduación de V4 de DeepSeek de estado de producción opcional a bloqueado. El posicionamiento centrado en eficiencia—capacidad fronteriza del 90% al 40-50% de los costos de API rivales—ha ganado tracción a medida que las empresas priorizan el costo de despliegue sobre ganancias de capacidad marginales. V4-Flash se ha convertido en la columna vertebral del agente predeterminado para cargas de trabajo sensibles a costos; V4-Pro tiene como objetivo tareas de generación de código y razonamiento donde la escala de parámetro 1.6T justifica compensaciones de costos. El plazo del 24 de julio crea una función de forzamiento suave para la planificación de migración, aunque las integraciones existentes continúan funcionando con IDs heredados hasta el corte.
Fuentes
- Primary source
- api-docs.deepseek.com
“deepseek-chat & deepseek-reasoner will be fully retired and inaccessible after Jul 24th, 2026, 15:59 (UTC Time)”
- kie.ai
“V4-Pro at 1.6T total parameters with 49B activated, V4-Flash at 284B total with 13B activated”
- explainx.ai
“The official version of DeepSeek V4 is planned to launch in mid-July with peak-hour pricing mechanism”