Google envía Gemini 3.6 Flash con 17% menos tokens, precio $7.50; 3.5 Pro aún retrasado
Google lanzó Gemini 3.6 Flash el 21 de julio de 2026 como su modelo workhorse para agentic coding, trabajo de conocimiento, y tareas multimodal. Precio de tokens de salida cayó de $9.00 a $7.50 por millón (entrada sin cambios en $1.50), y el modelo consume 17% menos output tokens por tarea que Gemini 3.5 Flash en el Índice Artificial Analysis, alcanzando ganancias de eficiencia 65% en benchmarks agentic específicos como DeepSWE. El corte de precio de etiqueta combinado más eficiencia de token se compone en una reducción de costo efectiva 31% por tarea completada, con ahorros de hasta 71% en cargas de trabajo agentic coding.
Google también envió Gemini 3.5 Flash-Lite a $0.30/$2.50 por millón tokens para tareas alto-throughput y anunció Gemini 3.5 Flash Cyber, modelo tuned-seguridad restringido a acceso gobierno y socios. Corte de conocimiento marzo 2026 representa avance 14 meses sobre enero 2025 de 3.5 Flash fecha. En benchmarks agentic aplicados, 3.6 Flash ganó terreno: DeepSWE mejoró 37% a 49%, MLE Bench 49.7% a 63.9%, OSWorld computer-use 78.4% a 83.0%.
Sin embargo, en el Índice Artificial Analysis Intelligence independiente, Gemini 3.6 Flash puntaá exactamente 50—sin cambios de 3.5 Flash. Esta es una versión de eficiencia, no un salto de capacidad. El modelo negocia poder de razón bruta por eficiencia de token y latencia menor, optimizando para la económica específica de cargas de trabajo agentic en lugar de profundidad de razón frontera. Artificial Analysis midió independientemente tiempo de finalización de tarea promedio cayendo de 2.7 minutos a 1.3 minutos y costo promedio por tarea de $0.59 a $0.50.
Notablemente ausente: Gemini 3.5 Pro permanece en prueba de socio sin fecha de disponibilidad pública, habiendo perdido su promesa I/O mayo 2026 y objetivo posterior junio. Mientras Google envía tres modelos, el flagship de la generación 3.5 está bloqueado. Pre-entrenamiento de Gemini 4 ha comenzado y enviará después. Para equipos ejecutando inferencia agentic alto-volumen, eficiencia y precios 3.6 Flash importan; para aquellos evaluando capacidad flagship, cronograma de entrega de Google sigue rezagado Anthropic OpenAI.
Fuentes
- Primary source
- 9to5google.com
“Gemini 3.6 Flash consumes 17% fewer output tokens compared to 3.5 Flash, while taking fewer reasoning steps and tool calls to accomplish multi-step workflows, and is priced lower at $1.50/1M input tokens and $7.50/1M output tokens”
- trilogyai.substack.com
“Gemini 3.6 Flash pricing is $1.50/$7.50 per million tokens — but token efficiency gains mean the effective cost per completed task drops ~31%, and up to ~71% on agentic coding workloads”
- felloai.com
“On the Artificial Analysis Intelligence Index it scores around 50 which is above the field average, but roughly flat against 3.5 Flash”
- 9to5google.com
“Gemini 3.6 Flash scores 49 percent on DeepSWE benchmark, a notable increase from the 37 percent achieved by version 3.5, and pushes machine learning engineering performance higher, scoring 63.9 percent on MLE-Bench compared to 49.7 percent previously”
- techcrunch.com
“Google teased the release of Pro as part of the 3.5 Flash release in May, saying the Pro version was already being used internally, and we look forward to rolling it out next month. Last week, Bloomberg reported that Google was facing internal delays in launching the 3.5 Pro”