Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética
O Google lançou três novos modelos Gemini na terça-feira enquanto se prepara para resultados e enfrenta concorrência cada vez mais intensa de rivais de IA chineses. O Gemini 3.6 Flash melhora o desempenho de codificação, multimodal e trabalho de conhecimento, reduzindo o uso de token de saída em 17% em comparação com 3.5 Flash e reduzindo o custo por token de saída para $1,50/M entrada, $7,50/M saída. O modelo mostra 49% de precisão na edição de código DeepSWE (vs. 37% para 3.5 Flash) e 83,0% em tarefas de computador OSWorld (vs. 78,4% para geração anterior.
O Gemini 3.5 Flash-Lite visa workloads de alto volume e baixa latência a apenas $0,30/M tokens de entrada e $2,50/M tokens de saída, funcionando a 350 tokens de saída por segundo de acordo com Artificial Analysis—o mais rápido da família 3.5. Ele superforma significativamente gerações mais antigas de Flash-Lite em workflows com agentes e inclui capacidades de computador integradas. O Gemini 3.5 Flash Cyber, lançado em piloto limitado para governos e parceiros confiáveis, é um modelo especializado emparelhado com CodeMender, agente de segurança de código do Google, projetado para detectar e corrigir vulnerabilidades de software a custo menor por token do que modelos maiores.
O roteiro mais amplo do Google sinaliza confiança: 3.5 Pro está em teste com parceiros antes do lançamento mais amplo, e a empresa iniciou sua maior execução de pré-treinamento até agora para Gemini 4. O lançamento responde ao impulso de rivais chineses—Kimi K3 da Moonshot AI atingiu restrições de capacidade de demanda, e Alibaba está provocando Qwen 3.8 Max. Para profissionais, a redução de 17% de token do 3.6 Flash e desempenho aprimorado com agentes a custo menor por tarefa o tornam a escolha clara para sistemas de agentes multiturnos e análise de documentos em escala.