aiexpert
Início / Notícias / Nota
Research · 13 de ago. de 2026, 08:32 · 1 fonte

A SpaceXAI lança Grok 4.6 com pontuação de Inteligência AA de 61, preços de $2/$6; Grok 4.7 (2,1T) esperado em semanas

A SpaceXAI lançou Grok 4.6 em 12 de agosto de 2026, um modelo de 1,5 trilhão de parâmetros construído para tarefas agentivas de longa execução e trabalho visual/interativo. O benchmark de título é que Grok 4.6 corresponde a GPT-5.6 Sol Max em 61 no Índice de Inteligência de Análise Artificial (um composto de 9 benchmarks). O modelo marca 1753 ELO em GDPVal-AA v2 (trabalho de conhecimento) e lidera em CursorBench 3.2 (69,9%) e FrontierCode. O preço é $2 por milhão de tokens de entrada, $6 por milhão de tokens de saída—aproximadamente 60% mais barato que Claude Opus 5 ($5/$25) ou GPT-5.6 Sol ($5/$30).

Grok 4.6 é treinado para fluxos de trabalho agentivos com múltiplas etapas: pesquisa, análise de base de código, CAD, desenvolvimento web, otimização de kernel. xAI aplicou treinamento suplementar mais longo que Grok 4.5, dados gerados por modelo curado para raciocínio, e usou Grok 4.5 para regenerar trajetórias SFT em domínios (STEM, engenharia de software, trabalho de conhecimento), filtrando traços problemáticos com verificações baseadas em modelo. RL foi aplicado em tarefas agentivas incluindo ambientes específicos de domínio. xAI relata comportamento melhorado de autoteste e verificação em trajetórias mais longas, e primeiros passes visuais/interativos mais fortes.

A estratégia de lançamento visa desenvolvedores no Cursor (o editor de código nativo de IA) com crédito de uso 2x pela primeira semana. Grok 4.6 está ativo no Cursor, Grok Build e na API; disponível via OpenRouter, Vercel e Cloudflare. Elon Musk confirmou que Grok 4.7—um modelo de parâmetros 2,1T maior—já está em treinamento, esperado em semanas; xAI sinaliza um ciclo de lançamento de 2-3 semanas.

Para construtores de agentes e arquitetos de plataforma: Grok 4.6 compete em custo e eficiência de etapa agentiva (supostamente ~53 etapas vs ~103 para Claude Opus 5 em tarefas com múltiplas etapas), não rendimento bruto. A fundação 1,5T reutilizada de 4.5 mantém latência e overhead de token baixos. Verificação independente (LMSYS Chatbot Arena) está pendente; trate a paridade do Índice de Inteligência da AA como provísória. Observe se a estratégia de distribuição do Cursor se traduz em mudanças significativas de adoção e se o cronograma agressivo do Grok 4.7 se mantém.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source x.ai