aiexpert
Inicio / Noticias / Nota
Research · 13 ago 2026, 12:03 · 4 fuentes

xAI lanza Grok 4.6 con precios de $2/$6; 'nuevo estándar' para codificación agentic vs. pares fronterizos

xAI lanzó Grok 4.6, un modelo de 1,5 billones de parámetros con entrenamiento complementario extendido enfocado en tareas agentic de larga duración, descrito como un gran paso adelante desde 4.5 al mismo precio.

Los benchmarks muestran que Grok 4.6 alcanza 88.4% en Terminal-Bench v2.1 y desempeño competitivo en Code Arena con GPT-5.6 Sol, mientras que evaluaciones independientes de Artificial Analysis lo colocan en #61 en el Índice de Inteligencia, aproximadamente en línea con GPT-5.6 Sol Max pero detrás de Claude Opus/Fable.

El precio es un diferenciador central: Grok 4.6 cuesta $2/$6 por 1M de tokens de entrada/salida, materialmente por debajo de pares fronterizos, con profesionales encuadrándolo inmediatamente como el nuevo estándar para cargas de trabajo de codificación y detección de errores.

El entrenamiento de Grok 4.6 enfatizó RL agentic en codificación, desarrollo web, diseño asistido por computadora y tareas de optimización de kernel, con mejoras reportadas en el comportamiento de auto-prueba en tareas largas y desempeño más estable en benchmarks pesados de razonamiento.

Los arquitectos se importan: con el 37% del precio fronterizo (Grok 4.6 $2/$6 vs. GPT-5.6 Sol en $5+/$15 típico), Grok 4.6 cambia el tradeoff costo-capacidad para agentes de codificación y trabajo de conocimiento autónomo; combinado con el lanzamiento del producto Grok Bot team-member, esto señala que xAI/SpaceX está entrando seriamente en la categoría de 'codificación agentic'.

Fuentes

Todo lo que sostiene esta nota
  1. 01 Primary source latent.space
  2. 02 latent.space latent.space “Grok 4.6 released: 1.5T model with longer supplemental training, improved agentic RL on coding, web, CAD, kernel optimization; pricing $2/$6 per 1M input/output tokens”
  3. 03 latent.space latent.space “AA-Briefcase agentic knowledge work: Grok 4.6 competitive with Claude Opus/Fable at materially lower cost; Terminal-Bench v2.1: 88.4%; Code Arena slots near GPT-5.6 Sol”
  4. 04 latent.space latent.space “Grok Bot early beta: agentic teammate, signs into tools, performs real work; Grok 4.7 already in training with supplemental run on SpaceX internal data planned”