Gemini Omni
Volver a artículos
8 min de lectura

Google presenta Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber: todo lo que necesitas saber

Google acaba de lanzar Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber. Precios, benchmarks, disponibilidad, seguridad y la hoja de ruta hacia Gemini 4, al detalle.

Gemini 3.6 FlashGemini 3.5 Flash-LiteGemini 3.5 Flash CyberModelsAnnouncement2026Español

Tres nuevos modelos Flash en un solo día

El 21 de julio de 2026, Google anunció tres nuevos modelos Gemini de una sola vez: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y Gemini 3.5 Flash Cyber. El hilo conductor es inconfundible: los tres atacan el mismo problema que los desarrolladores llevan tiempo señalando. Los agentes de IA en producción necesitan mayor eficiencia de tokens, menor latencia y un rendimiento más fiable, no solo puntuaciones más llamativas.

Este artículo desglosa para qué sirve cada modelo, cuánto cuesta, dónde puedes usarlo hoy y qué adelantó Google sobre el futuro (spoiler: Gemini 3.5 Pro está en pruebas con socios y el entrenamiento previo de Gemini 4 ya ha comenzado). Todas las cifras proceden del anuncio oficial.

La gama de un vistazo

ModeloRolDato claveAcceso
Gemini 3.6 FlashCaballo de batalla: código, trabajo del conocimiento, multimodal17% menos tokens de salida que 3.5 Flash, a menor precioDisponible de forma general hoy
Gemini 3.5 Flash-LiteEl modelo de clase 3.5 más rápido y rentable350 tokens de salida/s (Artificial Analysis)Disponible de forma general hoy
Gemini 3.5 Flash CyberEspecialista en seguridad para hallar y corregir vulnerabilidadesRendimiento de frontera en CyberGym dentro de CodeMenderSolo piloto de acceso limitado

Gemini 3.6 Flash: el nuevo caballo de batalla

3.6 Flash se construye directamente sobre el feedback de los desarrolladores con 3.5 Flash. El argumento de venta es inusual para un lanzamiento: no es solo mejor, es más frugal. En el Artificial Analysis Index consume un 17% menos de tokens de salida que 3.5 Flash, y en algunos benchmarks —como DeepSWE de Datacurve— Google observó reducciones de hasta el 65%. Además necesita menos pasos de razonamiento y llamadas a herramientas para completar flujos de varios pasos, lo que se traduce en ahorros reales en tareas agénticas.

Mejoras de benchmark de Gemini 3.6 Flash sobre 3.5 Flash en DeepSWE, MLE Bench, OSWorld-Verified y GDPval-AA v2

Lo más destacado frente a 3.5 Flash:

BenchmarkGemini 3.6 FlashGemini 3.5 Flash
DeepSWE (código agéntico)49%37%
MLE Bench (investigación en ML)63.9%49.7%
OSWorld-Verified (uso de ordenador)83.0%78.4%
GDPval-AA v2 (trabajo del conocimiento)14211349

Otros dos detalles del lanzamiento importan para quien construye:

  • El uso de ordenador (computer use) es ahora una herramienta integrada del lado del cliente vía la API de Gemini y Gemini Enterprise, sin necesidad de andamiaje adicional.
  • Entre los primeros clientes están Figma, Harvey, Hebbia y JetBrains; Hebbia y Harvey destacan especialmente las capacidades multimodales: análisis de documentos, gráficos y datos, y redacción de informes.

La demo de Google comparando la eficiencia de tokens en una tarea de OSWorld merece un vistazo: demo de eficiencia de tokens 3.6 Flash vs 3.5 Flash (vídeo).

Para el cara a cara completo, consulta nuestro análisis en profundidad Gemini 3.6 Flash vs 3.5 Flash.

Gemini 3.5 Flash-Lite: hecho para escalar flujos agénticos

Flash-Lite es la apuesta por el volumen. Es el modelo más rápido de la serie 3.5, con 350 tokens de salida por segundo (Artificial Analysis), pensado para búsqueda agéntica, procesamiento de documentos y cualquier pipeline donde el rendimiento sea el cuello de botella.

El salto de calidad sobre 3.1 Flash-Lite es dramático: Terminal-Bench 2.1 con 54% frente a 31%, GDM-MRCR v2 de contexto largo con 72.2% frente a 60.1% y GDPval-AA v2 con 1140 frente a 642. Sorprendentemente, incluso supera al mayor Gemini 3 Flash en varias evaluaciones agénticas, incluidas SWE-Bench Pro (54.2% frente a 49.6%) y OSWorld-Verified (74.0% frente a 65.1%).

Incluye niveles de pensamiento configurables —usa minimal/low para tareas de alto volumen sensibles a la latencia, o sube el nivel para cargas de subagentes de varios pasos— y el uso de ordenador también viene integrado. Entre los primeros clientes están Ashler, Palo Alto Networks y Ramp, y el modelo se está desplegando dentro de la Búsqueda de Google y la app de Gemini.

Nuestra guía de flujos agénticos con 3.5 Flash-Lite cubre en detalle niveles de pensamiento, cálculo de costes y selección de modelo.

Precios: más barato en ambos niveles

ModeloEntrada ($/1M tokens)Salida ($/1M tokens)Notas
Gemini 3.6 Flash$1.50$7.50Más barato que 3.5 Flash, y ~17% menos tokens de salida
Gemini 3.5 Flash-Lite$0.30$2.50La mejor relación precio-rendimiento para tráfico de alto volumen
Gemini 3.5 Flash CyberSin precio público; piloto de acceso limitado vía CodeMender

La verdadera historia de costes está en la multiplicación: 3.6 Flash cobra menos por token y emite menos tokens por tarea, así que el coste efectivo por tarea agéntica cae más de lo que sugiere la tarifa.

Gemini 3.5 Flash Cyber: un especialista tras el cordón de terciopelo

El tercer modelo es distinto. 3.5 Flash Cyber se basa en 3.5 Flash y está afinado para encontrar y corregir vulnerabilidades de seguridad a un precio por token inferior al de modelos más grandes. Funciona dentro de CodeMender, el agente de seguridad de código de Google, donde varios agentes 3.5 Flash Cyber colaboran para producir un único informe combinado, alcanzando un rendimiento competitivo de frontera en el benchmark CyberGym.

Resultados de Gemini 3.5 Flash Cyber en el benchmark CyberGym dentro de CodeMender

Como la tecnología es de doble uso, Google decidió deliberadamente no publicarla de forma amplia: estará disponible exclusivamente para gobiernos y socios de confianza a través de CodeMender, como piloto de acceso limitado. El objetivo es dar ventaja a los defensores de primera línea para parchear vulnerabilidades críticas antes de que se exploten.

Seguridad: menos jailbreaks, menos rechazos

3.6 Flash llega con salvaguardas Frontier Safety mejoradas que cubren el uso indebido en CBRN (químico, biológico, radiológico y nuclear) y ciberataques. Google afirma que el modelo es sustancialmente más resistente a los jailbreaks y, al mismo tiempo, está entrenado para minimizar los rechazos ante usos benignos: la combinación que los desarrolladores realmente quieren, en lugar de una postura torpe de rechazarlo todo.

Dónde puedes usarlos hoy

SuperficieGemini 3.6 FlashGemini 3.5 Flash-Lite
API de Gemini (Google AI Studio, Android Studio)
Google Antigravity
Gemini Enterprise Agent Platform
App Gemini Enterprise
App de Gemini
Búsqueda de Google✅ En despliegue
CodeMender (3.5 Flash Cyber)Piloto limitado: solo gobiernos y socios de confianza

El adelanto de la hoja de ruta: 3.5 Pro y Gemini 4

Dos apuntes de futuro enterrados en el anuncio merecen atención:

  1. Gemini 3.5 Pro está actualmente en pruebas con socios, con disponibilidad amplia prevista “en cuanto esté listo”.
  2. Google ha iniciado su entrenamiento previo más ambicioso hasta la fecha —para Gemini 4— y dice estar “entusiasmado con el progreso”.

Leídos juntos, los lanzamientos del nivel Flash parecen la capa de eficiencia que se consolida antes del siguiente salto de frontera.

En conclusión

Si construyes agentes, este es uno de esos raros lanzamientos donde el movimiento correcto es obvio: 3.6 Flash para trabajo agéntico sensible a la calidad, 3.5 Flash-Lite para alto volumen, ambos más baratos que lo que reemplazan. Flash Cyber, por su parte, señala hacia dónde cree Google que van los afinados especializados: potentes, estrechos y deliberadamente restringidos.

Relacionado