Google lanzó Gemini 3.7 Flash el 13 de agosto de 2026—solo tres semanas después de Gemini 3.6 Flash—como una actualización optimizada para codificación, uso de herramientas agénticas y flujos de trabajo de documentos empresariales. El modelo se lanza con precios introductivos de $0,75/1M tokens de entrada y $3,75/1M tokens de salida hasta el 31 de diciembre de 2026, luego se duplica a $1,50/$7,50 el 1 de enero de 2027.
Las ganancias de codificación son sustanciales. Gemini 3.7 Flash anota 65,3% en DeepSWE v1.1 (arriba de 49,0%), 43,6% en FrontierCode 1.1 Main (arriba de 34,4%) y 30,4% en AutomationBench (arriba de 17,0%). En el Índice de Inteligencia de Análisis Artificial, anota 56—justo detrás de modelos fronterizos como GPT-5.6 Terra (57) y Muse Spark 1.2 (57). No lideró en todos los benchmarks: Claude Sonnet 5 lidera en algunas tareas agénticas, y OSWorld 2.0 sigue siendo el dominio de GPT-5.6 Terra.
La velocidad y el costo por tarea son los movimientos destacados. A 340 tokens de salida por segundo, Gemini 3.7 Flash es casi 3x más rápido que GPT-5.6 Terra y lo coloca en la frontera Pareto de Inteligencia vs. Tiempo por Tarea con un tiempo promedio de tarea de 1,7 minutos (40% más rápido que Terra a razonamiento máximo). El costo por tarea cae 30% versus 3.6 Flash a pesar del precio de token idéntico, reflejando menos turnos y mejor eficiencia.
Para los desarrolladores, el tiempo importa: la tarifa introductoria vence a fines de 2026. Después del 1 de enero de 2027, los precios de entrada y salida se duplican. Incluso a la tarifa más alta, Gemini 3.7 Flash sigue siendo más barato que Claude Sonnet 5 y GPT-5.6 Terra. Este ciclo de lanzamiento rápido—tres tiers Flash en tres meses—refleja el posicionamiento competitivo de Google: impulsar actualizaciones frecuentes del modelo en lugar de esperar grandes saltos generacionales, apuntando a equipos que construyen agentes de codificación y automatización de más de un paso antes de que el mercado se consolide en un único estándar.