Google presenta Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber: todo lo que necesitas saber
Google acaba de lanzar Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber. Precios, benchmarks, disponibilidad, seguridad y la hoja de ruta hacia Gemini 4, al detalle.
Tres nuevos modelos Flash en un solo día
El 21 de julio de 2026, Google anunció tres nuevos modelos Gemini de una sola vez: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y Gemini 3.5 Flash Cyber. El hilo conductor es inconfundible: los tres atacan el mismo problema que los desarrolladores llevan tiempo señalando. Los agentes de IA en producción necesitan mayor eficiencia de tokens, menor latencia y un rendimiento más fiable, no solo puntuaciones más llamativas.
Este artículo desglosa para qué sirve cada modelo, cuánto cuesta, dónde puedes usarlo hoy y qué adelantó Google sobre el futuro (spoiler: Gemini 3.5 Pro está en pruebas con socios y el entrenamiento previo de Gemini 4 ya ha comenzado). Todas las cifras proceden del anuncio oficial.
La gama de un vistazo
| Modelo | Rol | Dato clave | Acceso |
|---|---|---|---|
| Gemini 3.6 Flash | Caballo de batalla: código, trabajo del conocimiento, multimodal | 17% menos tokens de salida que 3.5 Flash, a menor precio | Disponible de forma general hoy |
| Gemini 3.5 Flash-Lite | El modelo de clase 3.5 más rápido y rentable | 350 tokens de salida/s (Artificial Analysis) | Disponible de forma general hoy |
| Gemini 3.5 Flash Cyber | Especialista en seguridad para hallar y corregir vulnerabilidades | Rendimiento de frontera en CyberGym dentro de CodeMender | Solo piloto de acceso limitado |
Gemini 3.6 Flash: el nuevo caballo de batalla
3.6 Flash se construye directamente sobre el feedback de los desarrolladores con 3.5 Flash. El argumento de venta es inusual para un lanzamiento: no es solo mejor, es más frugal. En el Artificial Analysis Index consume un 17% menos de tokens de salida que 3.5 Flash, y en algunos benchmarks —como DeepSWE de Datacurve— Google observó reducciones de hasta el 65%. Además necesita menos pasos de razonamiento y llamadas a herramientas para completar flujos de varios pasos, lo que se traduce en ahorros reales en tareas agénticas.

Lo más destacado frente a 3.5 Flash:
| Benchmark | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| DeepSWE (código agéntico) | 49% | 37% |
| MLE Bench (investigación en ML) | 63.9% | 49.7% |
| OSWorld-Verified (uso de ordenador) | 83.0% | 78.4% |
| GDPval-AA v2 (trabajo del conocimiento) | 1421 | 1349 |
Otros dos detalles del lanzamiento importan para quien construye:
- El uso de ordenador (computer use) es ahora una herramienta integrada del lado del cliente vía la API de Gemini y Gemini Enterprise, sin necesidad de andamiaje adicional.
- Entre los primeros clientes están Figma, Harvey, Hebbia y JetBrains; Hebbia y Harvey destacan especialmente las capacidades multimodales: análisis de documentos, gráficos y datos, y redacción de informes.
La demo de Google comparando la eficiencia de tokens en una tarea de OSWorld merece un vistazo: demo de eficiencia de tokens 3.6 Flash vs 3.5 Flash (vídeo).
Para el cara a cara completo, consulta nuestro análisis en profundidad Gemini 3.6 Flash vs 3.5 Flash.
Gemini 3.5 Flash-Lite: hecho para escalar flujos agénticos
Flash-Lite es la apuesta por el volumen. Es el modelo más rápido de la serie 3.5, con 350 tokens de salida por segundo (Artificial Analysis), pensado para búsqueda agéntica, procesamiento de documentos y cualquier pipeline donde el rendimiento sea el cuello de botella.
El salto de calidad sobre 3.1 Flash-Lite es dramático: Terminal-Bench 2.1 con 54% frente a 31%, GDM-MRCR v2 de contexto largo con 72.2% frente a 60.1% y GDPval-AA v2 con 1140 frente a 642. Sorprendentemente, incluso supera al mayor Gemini 3 Flash en varias evaluaciones agénticas, incluidas SWE-Bench Pro (54.2% frente a 49.6%) y OSWorld-Verified (74.0% frente a 65.1%).
Incluye niveles de pensamiento configurables —usa minimal/low para tareas de alto volumen sensibles a la latencia, o sube el nivel para cargas de subagentes de varios pasos— y el uso de ordenador también viene integrado. Entre los primeros clientes están Ashler, Palo Alto Networks y Ramp, y el modelo se está desplegando dentro de la Búsqueda de Google y la app de Gemini.
Nuestra guía de flujos agénticos con 3.5 Flash-Lite cubre en detalle niveles de pensamiento, cálculo de costes y selección de modelo.
Precios: más barato en ambos niveles
| Modelo | Entrada ($/1M tokens) | Salida ($/1M tokens) | Notas |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | Más barato que 3.5 Flash, y ~17% menos tokens de salida |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | La mejor relación precio-rendimiento para tráfico de alto volumen |
| Gemini 3.5 Flash Cyber | — | — | Sin precio público; piloto de acceso limitado vía CodeMender |
La verdadera historia de costes está en la multiplicación: 3.6 Flash cobra menos por token y emite menos tokens por tarea, así que el coste efectivo por tarea agéntica cae más de lo que sugiere la tarifa.
Gemini 3.5 Flash Cyber: un especialista tras el cordón de terciopelo
El tercer modelo es distinto. 3.5 Flash Cyber se basa en 3.5 Flash y está afinado para encontrar y corregir vulnerabilidades de seguridad a un precio por token inferior al de modelos más grandes. Funciona dentro de CodeMender, el agente de seguridad de código de Google, donde varios agentes 3.5 Flash Cyber colaboran para producir un único informe combinado, alcanzando un rendimiento competitivo de frontera en el benchmark CyberGym.

Como la tecnología es de doble uso, Google decidió deliberadamente no publicarla de forma amplia: estará disponible exclusivamente para gobiernos y socios de confianza a través de CodeMender, como piloto de acceso limitado. El objetivo es dar ventaja a los defensores de primera línea para parchear vulnerabilidades críticas antes de que se exploten.
Seguridad: menos jailbreaks, menos rechazos
3.6 Flash llega con salvaguardas Frontier Safety mejoradas que cubren el uso indebido en CBRN (químico, biológico, radiológico y nuclear) y ciberataques. Google afirma que el modelo es sustancialmente más resistente a los jailbreaks y, al mismo tiempo, está entrenado para minimizar los rechazos ante usos benignos: la combinación que los desarrolladores realmente quieren, en lugar de una postura torpe de rechazarlo todo.
Dónde puedes usarlos hoy
| Superficie | Gemini 3.6 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|
| API de Gemini (Google AI Studio, Android Studio) | ✅ | ✅ |
| Google Antigravity | ✅ | — |
| Gemini Enterprise Agent Platform | ✅ | ✅ |
| App Gemini Enterprise | ✅ | — |
| App de Gemini | ✅ | ✅ |
| Búsqueda de Google | — | ✅ En despliegue |
| CodeMender (3.5 Flash Cyber) | Piloto limitado: solo gobiernos y socios de confianza |
El adelanto de la hoja de ruta: 3.5 Pro y Gemini 4
Dos apuntes de futuro enterrados en el anuncio merecen atención:
- Gemini 3.5 Pro está actualmente en pruebas con socios, con disponibilidad amplia prevista “en cuanto esté listo”.
- Google ha iniciado su entrenamiento previo más ambicioso hasta la fecha —para Gemini 4— y dice estar “entusiasmado con el progreso”.
Leídos juntos, los lanzamientos del nivel Flash parecen la capa de eficiencia que se consolida antes del siguiente salto de frontera.
En conclusión
Si construyes agentes, este es uno de esos raros lanzamientos donde el movimiento correcto es obvio: 3.6 Flash para trabajo agéntico sensible a la calidad, 3.5 Flash-Lite para alto volumen, ambos más baratos que lo que reemplazan. Flash Cyber, por su parte, señala hacia dónde cree Google que van los afinados especializados: potentes, estrechos y deliberadamente restringidos.