Gemini Omni
Volver a artículos
7 min de lectura

Gemini en octubre de 2026: 3.8 Live, 3.8 TTS, Omni en Vids, Gemini 4 Argon y Nano Banana 2.1

Resumen del 3 de septiembre al 8 de octubre: GA de 3.8 Live y TTS, Omni 1.1 en Google Vids, Lyria 3.5, anuncio de Gemini 4 Argon, Nano Banana 2.1 y corrección de la política de acceso a 2.5.

Gemini OmniGemini Omni FlashGemini 3.8 LiveGemini 3.8 Flash TTSGemini 4 ArgonNano Banana 2.12026

Del 3 de septiembre al 8 de octubre

Desde nuestra actualización de septiembre, Google ha publicado varios modelos en GA, ha cerrado un endpoint de preview de Omni y ha anunciado un nuevo modelo de texto insignia que los desarrolladores aún no pueden usar. Este artículo cubre del 3 de septiembre al 8 de octubre de 2026, con énfasis en cambios que siguen afectando a producción y plazos que conviene vigilar.

Novedades de Omni

Omni 1.1 Flash en Google Vids (23 de septiembre)

Según Google Workspace Updates, Omni 1.1 Flash entró en Google Vids el 23 de septiembre. Frente a la generación de vídeo anterior en Vids, Google destaca:

CapacidadNotas
Extensión de vídeoMayor calidad; mejor coherencia de personajes y audio
DuraciónEspecificar la longitud exacta del clip
ResoluciónGenerar 1080p directamente o escalar vídeo con IA a 1080p

Disponibilidad: Business Starter, Standard y Plus; Enterprise Starter, Standard y Plus; Education Plus; y cuentas personales de Google con Google AI Pro o Ultra. No hay interruptor de administrador: la función llega directamente a las cuentas elegibles.

Cierre del endpoint de preview (30 de septiembre)

gemini-omni-flash-preview se apagó según lo previsto el 30 de septiembre de 2026. Usa el modelo GA gemini-omni-1.1-flash para toda la API Omni Flash y cargas de producción.

Omni Pro

A 8 de octubre, Google no ha publicado una fecha GA para Gemini Omni Pro. La página de planes de suscripción de Google AI lista Omni Flash en la app Gemini y Flow; no lista Omni Pro. No hemos visto ninguna actualización oficial más allá del relato de preview Ultra-first de meses anteriores.

Gemini 3.8 Live (GA el 15 de septiembre)

Google publicó en GA la familia Gemini 3.8 Live el 15 de septiembre de 2026 para agentes de voz de baja latencia e interacción de audio en vivo.

ID del modeloRol
gemini-3.8-livePredeterminado para agentes de voz de baja latencia; razonamiento entrelazado; llamadas a funciones asíncronas activadas por defecto; actualizaciones de client content en toda la sesión
gemini-3.8-live-extended-thinkingMayor razonamiento; razonamiento en segundo plano durante audio en vivo, recomendado para tareas complejas

Desarrolladores: acceso vía Gemini API y Google AI Studio. Empresas: pueden solicitar preview privado de Gemini Enterprise. Consumidores: Search Live. Extended Thinking también está en Gemini Live y en Docs, Gmail y Keep.

gemini-3.8-live es ya la opción predeterminada para agentes de voz de Live API, por delante de gemini-3.1-flash-live-preview. Si aún apuntas al preview 3.1, planifica la migración y revisa los patrones de integración en nuestra guía de Gemini 3.1 Flash Live API.

Gemini 3.8 TTS (GA de API el 22 de septiembre)

La línea Gemini 3.8 Flash TTS alcanzó GA de API el 22 de septiembre; la entrada oficial del blog de Google fue el 23 de septiembre.

ID del modeloCaso de uso
gemini-3.8-flash-ttsDirección creativa, diseño de personajes, control línea a línea, dialectos, voz estable en conversaciones largas
gemini-3.8-flash-lite-ttsAlto rendimiento, menor coste; sustituto previsto de gemini-3.1-flash-tts-preview

Nueva superficie Voices API: /v1beta/voices admite diseño de voz, clonación de voz (con verificación de consentimiento) y más de 150 voces predefinidas y personalizadas. Gemini 3.8 Flash-Lite TTS también está en Google Vids; Gemini 3.8 Flash TTS en Gemini API y Google AI Studio, con acceso API de Gemini Enterprise indicado como próximamente.

Lyria 3.5 (GA el 3 de septiembre)

lyria-3.5 pasó a GA el 3 de septiembre para generación de canciones completas. Google cita mejor coherencia musical, voces más naturales y control más fino de duración y estructura. Entradas: texto e imagen. Salida: audio estéreo a 44,1 kHz.

Gemini 4 Argon (anunciado el 30 de septiembre)

El 30 de septiembre, Google anunció Gemini 4 Argon, un nuevo modelo insignia. Los desarrolladores no pueden usarlo hoy. El acceso se limita a defensores de ciberseguridad de confianza mediante el programa Fairwind mientras Google participa en el proceso voluntario del gobierno de EE. UU. de acceso previo al lanzamiento.

Tras ese proceso, Google planea abrir Argon primero a clientes de API de pago y suscriptores de Google AI Ultra. No se ha anunciado fecha de disponibilidad pública.

Precios introductorios (mientras dure el periodo introductorio):

Entrada (por 1M tokens)Salida (por 1M tokens)
Periodo introductorio$2$10
Entrada en caché95 % de descuento en tokens de entrada en caché—
Tras el periodo introductorio$4$20

No incorpores Argon en hojas de ruta de producción hasta que Google publique IDs de modelo y acceso general a la API. Contexto previo sobre la línea Gemini 4: vista previa de la hoja de ruta Gemini 4.

Nano Banana 2.1 (GA el 6 de octubre)

gemini-nano-banana-2.1 alcanzó GA el 6 de octubre para generación de imágenes y edición conversacional. Google informa de mejor calidad de imagen, adherencia al prompt, coherencia de personajes en varios turnos y renderizado de texto.

Nuevas relaciones de aspecto: 1:4, 4:1, 1:8, 8:1, con tamaños de salida 1K, 2K y 4K.

gemini-3.1-flash-image está obsoleto y se apaga el 29 de octubre de 2026. Migra antes de esa fecha.

from google import genai

client = genai.Client()

response = client.models.generate_content(
    model="gemini-nano-banana-2.1",  # antes gemini-3.1-flash-image
    contents="Foto de producto sobre fondo blanco, sombra suave.",
)

Otros cambios de API

FechaCambio
1 de septiembreAgentic video understanding en gemini-3.7-flash, gemini-3.6-flash y gemini-3.5-flash-lite: comprensión de vídeo largo con hasta un 88 % menos de tokens
17 de septiembreantigravity-preview-09-2026 sustituye a antigravity-preview-05-2026; el preview de mayo se apagó el 5 de octubre
Herramientas locales AntigravityLos nombres de parámetros pasaron de snake_case a PascalCase; las ediciones de archivo usan reemplazos por rango de líneas en lugar de reescrituras completas
Sandbox remoto AntigravitySi solo lees output_text / model_output, actualiza la cadena del modelo agent; no hace falta cambiar el parser de herramientas locales

Corrección del estado de Gemini 2.5

Google actualizó su orientación el 18 de septiembre: la familia Gemini 2.5 no está en desuso. Los modelos siguen disponibles hasta nuevo aviso, pero el acceso se limita a cuentas que ya usaron 2.5. Proyectos nuevos deben usar gemini-3.5-flash-lite o gemini-3.8-flash.

Nuestra actualización de septiembre de 2026 citaba una fecha de retirada de 2.5 el 16 de octubre de 2026; ese calendario ya no aplica. Hemos corregido ese artículo para alinearlo con la política actual de Google.

Lista de acciones para octubre

  1. Confirma que la producción Omni usa gemini-omni-1.1-flash (el endpoint de preview ya está apagado).
  2. Evalúa gemini-3.8-live (y Extended Thinking si necesitas más razonamiento en audio en vivo) para agentes de voz.
  3. Migra de gemini-3.1-flash-image antes del 29 de octubre de 2026; destino gemini-nano-banana-2.1.
  4. Si llamas herramientas locales de Antigravity, actualiza los parsers para parámetros PascalCase y ediciones por rango de líneas.
  5. No planifiques producción en torno a Gemini 4 Argon hasta que Google ofrezca acceso general para desarrolladores.

Lecturas relacionadas