Google lanza Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite y modelo de seguridad cibernética
Google lanzó tres nuevos modelos Gemini el martes mientras se prepara para ganancias y enfrenta creciente competencia de rivales chinos de IA. Gemini 3.6 Flash mejora el rendimiento de codificación, multimodal y trabajo de conocimiento, reduciendo el uso de token de salida en 17% en comparación con 3.5 Flash y reduciendo el costo por token de salida a $1,50/M entrada, $7,50/M salida. El modelo muestra 49% de precisión en edición de código DeepSWE (vs. 37% para 3.5 Flash) y 83,0% en tareas de computadora OSWorld (vs. 78,4% para generación anterior).
Gemini 3.5 Flash-Lite apunta a cargas de trabajo de alto volumen y baja latencia por solo $0,30/M tokens de entrada y $2,50/M tokens de salida, ejecutándose a 350 tokens de salida por segundo según Artificial Analysis—el más rápido de la familia 3.5. Supera significativamente a generaciones más antiguas de Flash-Lite en flujos de trabajo con agentes e incluye capacidades de computadora integradas. Gemini 3.5 Flash Cyber, lanzado en piloto limitado para gobiernos y socios confiables, es un modelo especializado emparejado con CodeMender, agente de seguridad de código de Google, diseñado para detectar y parchar vulnerabilidades de software a menor costo por token que modelos más grandes.
La hoja de ruta más amplia de Google señala confianza: 3.5 Pro está en prueba de socios antes del lanzamiento más amplio, y la empresa ha comenzado su mayor ejecución de pre-entrenamiento hasta ahora para Gemini 4. El lanzamiento responde al impulso de rivales chinos—Kimi K3 de Moonshot AI golpeó restricciones de capacidad por demanda, y Alibaba está insinuando Qwen 3.8 Max. Para profesionales, la reducción del 17% de tokens de 3.6 Flash y el rendimiento mejorado de agentes a menor costo por tarea lo convierten en la opción clara para sistemas de agentes de múltiples turnos y análisis de documentos a escala.