Google lançou Gemini 3.7 Flash em 13 de agosto de 2026—apenas três semanas após Gemini 3.6 Flash—como uma atualização otimizada para codificação, uso de ferramentas agénticas e fluxos de trabalho de documentos empresariais. O modelo lança com preços introdutórios de $0,75/1M tokens de entrada e $3,75/1M tokens de saída até 31 de dezembro de 2026, depois dobrando para $1,50/$7,50 em 1 de janeiro de 2027.
Os ganhos de codificação são substanciais. Gemini 3.7 Flash marca 65,3% em DeepSWE v1.1 (acima de 49,0%), 43,6% em FrontierCode 1.1 Main (acima de 34,4%) e 30,4% em AutomationBench (acima de 17,0%). No Índice de Inteligência de Análise Artificial, marca 56—logo atrás de modelos de fronteira como GPT-5.6 Terra (57) e Muse Spark 1.2 (57). Não ficou em primeiro em todos os benchmarks: Claude Sonnet 5 lidera em algumas tarefas agénticas, e OSWorld 2.0 permanece dominão de GPT-5.6 Terra.
Velocidade e custo por tarefa são os movimentos destaque. Em 340 tokens de saída por segundo, Gemini 3.7 Flash é quase 3x mais rápido que GPT-5.6 Terra e o coloca na fronteira de Pareto de Inteligência vs. Tempo por Tarefa com um tempo médio de tarefa de 1,7 minuto (40% mais rápido que Terra no raciocínio máximo). O custo por tarefa cai 30% versus 3.6 Flash apesar do preço de token idêntico, refletindo menos voltas e melhor eficiência.
Para desenvolvedores, o tempo importa: a taxa introdutória expira no final de 2026. Após 1 de janeiro de 2027, o preço de entrada e saída dobraria. Mesmo na taxa mais alta, Gemini 3.7 Flash permanece mais barato que Claude Sonnet 5 e GPT-5.6 Terra. Este ciclo de lançamento rápido—três tiers Flash em três meses—reflete o posicionamento competitivo do Google: empurrando atualizações frequentes de modelo em vez de aguardar saltos geracionais importantes, visando equipes construindo agentes de codificação e automação multietapa antes do mercado consolidar em torno de um padrão único.