aiexpert
Início / Notícias / Nota
Market · 22 de ago. de 2026, 13:03 · 5 fontes

Modelos de IA chineses DeepSeek, Qwen fecham gap de performance com EUA a 90% de custo menor

Modelos de IA chineses de DeepSeek e Alibaba (Qwen) estão entregando raciocínio e performance de coding em nível frontier enquanto subcortam modelos flagship dos EUA em 85–95% nos preços de API. DeepSeek-V4 Flash custa $0,14 por milhão de tokens de input versus $0,20 de GPT-5.6 Luna; Qwen3.8-Max em $2/M input e $6/M output (agora open-weight desde 12 de agosto) corresponde Claude Sonnet 4.6 e se aproxima GPT-5.1 em benchmarks de preferência do usuário Arena-Hard. GLM-5.2 de Zhipu AI, lançado em junho, ficou em topo de leaderboards de código open-weight. O gap de performance que ficou em 17–31 pontos em 2023 colapsou para 2,7 pontos percentuais em março de 2026, segundo AI Index de Stanford, com lançamentos de verão estreitando ainda mais.

Tanto DeepSeek quanto Qwen alavancam arquiteturas Mixture-of-Experts (ativando apenas uma fração de parâmetros por token), lançamentos open-weight sob licenças permissivas (MIT ou Apache 2.0), e custos de infraestrutura menores para alcançar essa compressão de gap. DeepSeek relata que treinou V3 por ~$5,6 milhões em ~2.000 GPUs H800-equivalentes—uma fração de orçamentos de treinamento Ocidentais—e agora envia variantes Flash que rodam em servidores empresariais únicos com 142GB memória GPU. Qwen, a família de modelo open mais baixada em Hugging Face (40%+ de novas variantes LLM), usa técnicas de eficiência similares. Ambos modelos aceitam self-hosting, endereçando preocupações de residência de dados para implantações reguladas.

Este shift impacta cada time avaliando lock-in de provedor de inferência. Para batch, raciocínio e tarefas de coding médio-volume, modelos chineses agora oferecem vitórias claras de custo-por-tarefa enquanto encontram capability em nível EUA em benchmarks como DeepSWE e HumanEval. Times usando Claude ou GPT-5 para workloads alto-volume enfrentam pressão de preços competitiva. Escrutínio de política dos EUA em adoção de modelo chinês (investigações em Cursor e Airbnb) adiciona fricção de implantação mas não muda a equação econômica.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source bloomberg.com
  2. 02 AICost: Chinese AI models 90-95% cost savings aicost.org
  3. 03 GEO Toolbox: Qwen, DeepSeek, GLM comparison August 2026 geotoolbox.ai
  4. 04 The Register: Qwen 3.8-Max and DeepSeek V4 release analysis theregister.com
  5. 05 Rest of World: Chinese models adoption US market 2026 restofworld.org