aiexpert
Inicio / Noticias / Nota
Market · 22 ago 2026, 12:36 · 5 fuentes

Modelos de IA chinos reducen costos de tokens 5–12x por debajo de Claude/GPT; desarrolladores cambiando valores predeterminados hasta agosto 2026

Proveedores de modelos de IA chinos han desencadenado una guerra de precios de API, con DeepSeek, Kimi, GLM y otros laboratorios precificando modelos flagship a 5–12 veces por debajo de tiers equivalentes de OpenAI y Anthropic. En OpenRouter, plataforma que agrega acceso a modelos, la participación de tokens de empresas estadounidenses para modelos chinos ha estado por encima del 30% cada semana desde febrero de 2026, llegando a 46%—en comparación con un promedio del 11% en los 12 meses anteriores. Benchmarks independientes muestran que cargas de trabajo típicas de producción migran a modelos chinos con reducción de costos del 87% mientras la calidad de salida cae solo ~4% en tareas promedio.

La brecha de costos es drástica en el extremo premium. DeepSeek V4 Pro ejecuta una carga de trabajo estándar por aproximadamente $11 mientras GPT-5.6 Sol cuesta ~$788 en el mismo trabajo—un delta de 70x en la práctica. Claude Opus 5 ($5/$25 por millón de tokens de entrada/salida) se compara con DeepSeek en $0,30/$1,50. Ernie de Baidu, GLM-5.2 de Zhipu AI (entrenado en fracción de compute, aún rival de GPT en codificación) y M3 de MiniMax todos subestiman los precios de referencia. Esto sigue los cortes de precio agresivos de ByteDance, Alibaba y Tencent: Alibaba redujo los precios de Qwen hasta 97%, y Baidu hizo modelos Ernie gratis para usuarios empresariales.

Los desarrolladores están reaccionando en producción. Lindy AI movió el 100% del tráfico de Claude a DeepSeek en junio y proyecta ahorros de millones por mes. GLM-5.2 de Z.ai vio la adopción más rápida de cualquier modelo en Vercel en 2026, con volumen diario de tokens creciendo 27x y cantidad de clientes creciendo 80x en su primera semana completa después del lanzamiento. Para arquitectos, la pregunta estratégica cambia de '¿podemos permitirnos modelos frontier?' a '¿dónde aceptamos la brecha de calidad del 4-18% y auto-hospedamos vs. hospedaje en la nube para preservar la soberanía de datos?' Pesos abiertos para DeepSeek, GLM y Kimi K3 (licencias MIT/Apache) hacen que el auto-hospedaje sea legal y viable, pero las APIs chinas hospedadas plantean cuestiones de gobernanza de datos que requieren una auditoría legal caso por caso.

Fuentes

Todo lo que sostiene esta nota
  1. 01 Primary source newmarketpitch.com
  2. 02 newmarketpitch.com newmarketpitch.com “DeepSeek V4 Pro is around 21 times cheaper than GPT-5.6 Sol; MiniMax M3 is around 19 times cheaper than Claude Opus 5”
  3. 03 cnbc.com cnbc.com “Token share from U.S. companies on Chinese models has sat above 30% each week since Feb 8, peaking at 46%; Lindy moved 100% of traffic from Anthropic to DeepSeek”
  4. 04 setproduct.com setproduct.com “Across a typical production workload, swapping to Chinese alternatives cuts operating cost by roughly 87% while average output quality drops by only about 4%”
  5. 05 bloomberg.com bloomberg.com “Chinese AI models can build passable websites at a 75% discount to Claude”