Google anunció el 21 de julio tres nuevos modelos de la familia Gemini orientados a agentes de IA en producción. Gemini 3.6 Flash es el nuevo modelo de trabajo general, 17% más eficiente en tokens que su predecesor y con mejor rendimiento en coding; Gemini 3.5 Flash-Lite es el más rápido de la serie 3.5, capaz de generar 350 tokens por segundo; y Gemini 3.5 Flash Cyber es un modelo especializado en ciberseguridad que solo estará disponible para gobiernos y socios de confianza a través del agente CodeMender.
Lo publica Tulsee Doshi, directora senior de gestión de producto del equipo Gemini, en el blog oficial de Google el 21 de julio.
Gemini 3.6 Flash: el modelo de trabajo más barato que su predecesor
3.6 Flash mejora directamente sobre 3.5 Flash en los tres vectores que importan para los desarrolladores que lo usan en producción:
Eficiencia: Usa un 17% menos de tokens de salida que 3.5 Flash según el Artificial Analysis Index. En algunos benchmarks como DeepSWE de Datacurve, la reducción llega al 65%. Menos tokens significa menor coste por tarea agente.
Calidad: DeepSWE (coding en entornos reales): 49% vs. 37% del 3.5 Flash. MLE Bench (investigación ML): 63,9% vs. 49,7%. OSWorld-Verified (computer use): 83% vs. 78,4%.
Precio: $1,50 por millón de tokens de entrada y $7,50 por millón de tokens de salida — más barato que 3.5 Flash por tarea completa una vez incorporada la eficiencia de tokens. Figma, Harvey, Hebbia y JetBrains están entre los primeros clientes que publican casos de uso.
Computer use —la capacidad de controlar interfaces gráficas directamente— llega ahora como herramienta integrada en el cliente vía la API de Gemini y Gemini Enterprise, sin necesidad de configuración adicional.
3.6 Flash también incorpora salvaguardas mejoradas en dominios CBRN (químico, biológico, radiológico y nuclear) y ofensas cibernéticas, resistiendo mejor los intentos de jailbreak. Al mismo tiempo, fue entrenado para minimizar los rechazos en usos beneficiosos.
Gemini 3.5 Flash-Lite: 350 tokens por segundo y un salto generacional sobre los Flash-Lite anteriores
Flash-Lite está diseñado para dos casos de uso específicos: tareas de baja latencia y tareas donde el alto throughput es crítico, como búsqueda agente y procesamiento masivo de documentos.
Velocidad: 350 tokens/segundo según Artificial Analysis — el más rápido de la serie 3.5.
Precio: $0,30 por millón de tokens de entrada y $2,50 por millón de tokens de salida — uno de los menores precios del mercado en relación a sus capacidades.
Calidad: Da un salto generacional sobre 3.1 Flash-Lite: Terminal-Bench 2.1 sube de 31% a 54%; GDM-MRCR v2 (contexto largo) de 60,1% a 72,2%. Sorprendentemente, 3.5 Flash-Lite supera a los modelos más grandes en algunos benchmarks importantes como SWE-Bench Pro (54,2% vs. 49,6% del 3 Flash).
También incorpora computer use y configuración de «niveles de razonamiento» para elegir entre procesamiento de baja latencia (alto volumen, menos pasos) y razonamiento profundo (tareas multi-agente complejas).
3.5 Flash-Lite está disponible hoy en la API de Gemini, Google AI Studio y además empieza a desplegarse en Google Search.
Gemini 3.5 Flash Cyber: solo para gobiernos y socios de confianza
El tercer modelo del anuncio es el más inusual. 3.5 Flash Cyber está fine-tuned sobre 3.5 Flash específicamente para encontrar y reparar vulnerabilidades de ciberseguridad. Dentro de CodeMender —el agente de seguridad de código de Google DeepMind— varios agentes que corren 3.5 Flash Cyber trabajan en paralelo para producir un informe combinado. El resultado en el benchmark CyberGym es competitivo con los mejores modelos de frontera en ciberseguridad.
La disponibilidad es deliberadamente restringida: solo gobiernos y socios de confianza, vía un programa piloto de acceso limitado. Google justifica la restricción por la «naturaleza de doble uso» de la tecnología — el mismo modelo que encuentra vulnerabilidades para defenders puede usarse ofensivamente.
Lo que viene después
El post también menciona que Gemini 3.5 Pro está en pruebas con socios y se hará disponible ampliamente «tan pronto como esté listo.» Y que el equipo de Gemini «ya ha empezado el proceso de pre-training más ambicioso hasta ahora, para Gemini 4.»
CISA ya usa el modelo de ciberseguridad de Anthropic (Mythos) para auditar código gubernamental: Gemini 3.5 Flash Cyber accede al mismo espacio pero con la restricción de que solo gobiernos y socios de confianza podrán usarlo, al contrario que Mythos que tiene acceso más amplio bajo Glasswing. Google generó el primer exploit zero-day con IA en mayo de 2026 con su propio GTIG: el 3.5 Flash Cyber lleva esa capacidad a producción como servicio controlado para defenders, no para atacantes. La obligación de modificar Chrome impuesta por la sentencia antimonopolio americana no ha afectado al ritmo de lanzamientos de modelos de Google: los modelos Gemini siguen el calendario más agresivo de todos los labs.
Mi valoración
El anuncio de tres modelos simultáneos es la forma que Google tiene de demostrar que el retraso de Gemini Pro 3.5 —que lleva meses «en pruebas con socios» sin fecha de lanzamiento confirmada— no está paralizando el roadmap del resto de la familia.
Lo que más me convence es la decisión de desplegar 3.5 Flash-Lite en Google Search: es una señal de confianza en la capacidad del modelo para manejar el volumen de consultas de Google, que es uno de los entornos de inferencia más exigentes del mundo. Lo que más me preocupa de 3.5 Flash Cyber es el modelo de acceso: si solo los gobiernos y socios de confianza pueden detectar las vulnerabilidades que los atacantes también pueden encontrar, los defensores del sector privado siguen en desventaja.
Preguntas frecuentes
¿Puedo usar Gemini 3.6 Flash en mi app hoy?
Sí. Gemini 3.6 Flash y 3.5 Flash-Lite están disponibles desde hoy en la API de Gemini vía Google AI Studio (aistudio.google.com). También están disponibles en la consola de Google Cloud para empresas (Gemini Enterprise Agent Platform) y en la app Gemini para todos los usuarios.
¿Qué es Google Antigravity (AGY) que se menciona en el blog?
Google Antigravity es la plataforma de Google para agentic workflows, mencionada en el blog como una de las plataformas donde 3.6 Flash ya está disponible. Es el entorno de orquestación de agentes de Google, similar a lo que LangChain o CrewAI son en el ecosistema open-source.
¿Cómo se compara Gemini 3.5 Flash-Lite con los modelos pequeños de Anthropic y OpenAI?
Gemini 3.5 Flash-Lite a $0,30/1M input y $2,50/1M output tokens es comparable en precio a los modelos pequeños más económicos del mercado. En velocidad (350 tokens/segundo), supera a la mayoría de los modelos comparables disponibles vía API. La comparación de calidad depende del benchmark específico, pero en coding y tareas agente, el blog reporta que supera incluso a su propio 3 Flash, que es un modelo de mayor tamaño.
