Gemini Omni
Omni 1.1 Flash · Generación y edición de vídeo lista para producción

Gemini Omni
Habla, mira, comparte — vídeo multimodal en una conversación

Gemini Omni 1.1 Flash se lanzó el 27 de agosto de 2026 — la actualización lista para producción de Google con extensiones de escena de hasta 40 segundos, control del primer y último fotograma, modo borrador 360p, escalado 4K y referencias de vídeo. Reemplaza a Veo en la app Gemini y está disponible en Google Flow, YouTube Shorts, Google Vids, Google AI Studio y Gemini Enterprise Agent Platform.

Modelo unificado Audio sincronizado Edición en chat
Omni
Text
Image
Video
Audio

Cifras clave

10s · hasta 40s Duración del clip
4K Resolución máx.
16:9 · 9:16 · 1:1 Formatos
ago 2026 Último lanzamiento
Demos oficiales

Mira lo que realmente produce Gemini Omni

Todos los clips siguientes están incrustados directamente desde la página oficial de Gemini Omni: texto→vídeo, imagen→vídeo, transferencia de estilo, edición en chat, vídeo→vídeo y avatar de IA — toda la superficie de capacidades.

Todos los vídeos demo son © Google, usados aquí con fines informativos; se transmiten directamente desde storage.googleapis.com/gweb-gemini-cdn.

Speak it. See it. Share it.

Vídeo hero oficial de Gemini Omni: crear, remezclar y editar vídeo conversando.

Ver la página oficial
Texto → vídeo

Entra en la historia

Un prompt de texto produce un clip multi-plano con entorno y lenguaje de cámara coherentes.

Imagen → vídeo

Da vida a tus fotos

Sube imágenes de referencia y Omni anima el movimiento, llenando la línea de tiempo.

Estilo · plantilla

Conserva el alma del plano

Cambia fondos, vestuario o estilo — el sujeto mantiene sus detalles.

Vídeo → vídeo

Remezcla un clip existente

Reformula una toma en un nuevo estilo — iluminación, lente o incluso el material se reescriben con un prompt.

Edición en chat

Edición fácil

Reemplaza personajes, ajusta la iluminación o estabiliza la toma — todo conversando, sin regenerar.

Avatar de IA

Sé la estrella

Configura una vez tu avatar de IA y aparece en cada vídeo sin volver a subir fotos.

Capacidades

Toda la cadena creativa en un solo modelo

A diferencia de modelos especializados como Veo, Sora 2, Seedance 2.0 o Kling, Gemini Omni mantiene razonamiento de lenguaje, generación de imagen, generación de vídeo y síntesis de audio bajo una sola arquitectura.

Salida multimodal nativa

Un único prompt produce texto, fotogramas clave y vídeo que coinciden, con personajes, estilo e iluminación coherentes entre formatos.

Una pila Gemini unificada

Se acabó encadenar modelos especializados. Texto, imagen, vídeo y audio comparten los mismos pesos y el mismo contexto extenso.

Audio nativo sincronizado

Sonido ambiente, banda sonora y diálogo se alinean con la imagen en la misma pasada — pasos en el beat, labios sincronizados desde la primera exportación.

Edición directa en el chat

Cambia un objeto, modifica la iluminación o ajusta un movimiento de cámara en lenguaje natural — sin regenerar, siguiendo el guion de Nano Banana.

Remezcla y dirige

Sube un clip existente y redirígelo con prompts. Imágenes, vídeos y audios de referencia se combinan en una sola instrucción.

Plantillas y estilos

Plantillas integradas para anuncios, Reels, videoclips y cortos cinematográficos reducen la barrera y mantienen un lenguaje de cámara coherente.

Especificaciones

Especificaciones oficiales de Omni 1.1 Flash

Las cifras siguen el lanzamiento en producción del 27 de agosto de 2026 de gemini-omni-1.1-flash de Google. Disponible vía Google AI Studio y Gemini Enterprise Agent Platform.

Dimensión Información conocida
Familia Google Gemini Omni — 1.1 Flash es el lanzamiento listo para producción
ID del modelo gemini-omni-1.1-flash
Duración del clip Hasta 10 segundos por generación · hasta 40 segundos con extensiones de escena (incrementos de 10 segundos)
Resolución 360p borrador · 720p estándar · 1080p · escalado 4K
Formatos 16:9, 9:16, 1:1
Audio Audio nativo sincronizado en salida · referencias de audio en API aún no soportadas
Entradas Texto / imagen / vídeo (referencia de audio en API aún no soportada)
Acceso App Gemini, Google Flow, YouTube Shorts/Create, Google Vids · desarrolladores vía Gemini API, Google AI Studio y Gemini Enterprise Agent Platform
Precio API $0,10 por segundo de salida de vídeo (igual que Veo 3.1 Fast)
Arquitectura

Tres líneas de producto fusionadas en un Omni

La pila generativa de Google solía estar dividida en Veo (vídeo), Nano Banana / Imagen (imagen) y Gemini (texto). Omni las unifica en una sola arquitectura.

Antes

Veo 3.1

Vídeo + audio nativo

Nano Banana / Imagen

Generación y edición de imagen

Gemini 2.5 / 3.x

Razonamiento · contexto largo

Ahora · Omni

Gemini Omni

Texto · imagen · vídeo · audio, un modelo, un prompt

Text Image Video Audio
Casos de uso

De un brief a contenido publicable

Un modelo unificado con contexto largo y audio sincronizado permite escribir un brief coherente y obtener un corte final.

01

Anuncios de producto

Planos hero, revelaciones de packaging y cortes lifestyle con sonido ambiente ya bloqueado.

02

Reels y Shorts

Clips 9:16 con diálogo on-mic y movimiento sincronizado al ritmo, ideales para social.

03

Videoclips

Referencia una pista y Omni corta visuales al ritmo, con personajes consistentes entre planos.

04

Cortos cinematográficos

Encadena varios omni-clips de 10 s en secuencias multi-plano con iluminación y audio continuos.

05

Hero loops de landing

Clips 16:9 atmosféricos en bucle para SaaS, moda y DTC — branded y legibles en mute.

06

Explicativos y tutoriales

Convierte un guion en una secuencia narrada con diálogo sincronizado y sonido ambiente acorde.

Comparar

Dónde encaja Omni en el ecosistema de vídeo 2026

Agregado de Artificial Analysis, Looksy AI, Oimi AI y keynotes oficiales — orientativo, no benchmarks.

Modelo Fabricante Arquitectura Audio nativo Duración
Gemini Omni Omni
Google Omni unificado (vídeo + imagen + audio) Sincronizado en una pasada 10s · hasta 40s
Veo 3.1
Google Modelo de vídeo especializado ~8s
Seedance 2.0
ByteDance Vídeo multimodal especializado hasta 15s / plano
Sora 2
OpenAI Modelo de vídeo especializado ~20s
Kling V3.0
Kuaishou Modelo de vídeo especializado Limitado ~10s
Acceso gratis

¿Gemini Omni es gratis? Cómo usarlo gratis en 2026

Gemini Omni Flash es gratis en la capa gratuita de Google Flow, en YouTube Shorts y en la app YouTube Create. La app independiente de Gemini necesita Google AI Plus, Pro o Ultra. Abre los accesos oficiales abajo.

Cómo generar vídeos de Gemini Omni gratis

Ruta gratis más rápida: inicia sesión en YouTube Shorts o la app YouTube Create, elige una plantilla y usa los mismos prompts multi-toma que en la app Gemini.

  • Borradores gratis en YouTube Shorts para fijar lenguaje de cámara y ritmo.
  • Pasa al plan Google AI Plus o Pro solo cuando necesites calidad de marca.
  • Usa la edición conversacional en vez de regenerar para estirar cada crédito de pago.

Las cuotas gratis y los precios cambian según región y cuenta. Comprueba siempre los accesos oficiales arriba.

Cronología

Del primer filtrado al lanzamiento — y lo que viene

Ordenado por fecha de reporte público. Actualizado hasta el lanzamiento en producción de Omni 1.1 Flash del 27 de agosto de 2026.

  1. 2026 · 05 · 02

    Primer string "Powered by Omni"

    El usuario de X @Thomas16937378 detectó "Start with an idea or try a template. Powered by Omni." en la pestaña de vídeo de Gemini.

  2. 2026 · 05 · 11

    Tarjeta de preview en Gemini móvil

    TestingCatalog y Chetaslua revelaron la tarjeta "Meet our new video model", el ID completo y el límite de 10 segundos.

  3. 2026 · 05 · 12 – 18

    Las demos se viralizan

    Un clip de "profesor resolviendo trigonometría en una pizarra" mostró coherencia textual y fidelidad física, disparando comparativas con Veo 3.1.

  4. 2026 · 05 · 19

    Lanzamiento oficial en Google I/O 2026

    Google presenta Gemini Omni en el escenario principal de I/O 2026, publica la página de producto oficial con vídeos demo y comienza a reemplazar a Veo 3.1 en la app Gemini.

  5. 2026 · 05 · 19 en adelante

    Despliegue de avatar de IA, vídeo→vídeo y edición multi-turno

    El lanzamiento incluye un avatar de IA personal, edición vídeo a vídeo y edición multi-turno tipo chat — el rollout depende de país y nivel de suscripción.

  6. 2026 · 06 · 30

    Vista previa pública de la API Omni Flash para desarrolladores

    El ID de modelo gemini-omni-flash-preview llega a Google AI Studio, Gemini API y Gemini Enterprise Agent Platform a $0,10 por segundo de salida de vídeo — misma tarifa que Veo 3.1 Fast. Edición conversacional y referencias multimodales (texto, imagen, vídeo) soportadas; referencias de audio en API aún no.

  7. 2026 · 08 · 27

    Lanzamiento en producción de Gemini Omni 1.1 Flash

    El ID de modelo gemini-omni-1.1-flash pasa a producción vía Google AI Studio y Gemini Enterprise Agent Platform. Nuevas capacidades: extensiones de escena de hasta 40 segundos, especificación del primer y último fotograma, modo borrador 360p (60% más rápido, 1/3 del coste), escalado 4K y referencias de vídeo. Integrado por Adobe Firefly, Figma Weave, Runway y más.

  8. En la hoja de ruta

    Despliegue más amplio de Gemini Omni Pro + salidas de imagen y audio

    Google ha anunciado un despliegue más amplio de Gemini Omni Pro más allá de la vista previa Ultra, junto con modalidades de salida de imagen y audio más allá del lanzamiento actual centrado en vídeo — la promesa completa de "cualquier entrada → cualquier salida".

Preguntas frecuentes

Lo que más se pregunta sobre Gemini Omni

¿Qué es exactamente Gemini Omni?

Gemini Omni es la familia multimodal unificada de Google. El modelo en producción es Gemini Omni 1.1 Flash (gemini-omni-1.1-flash), que genera vídeo con audio nativo sincronizado a partir de entradas de texto, imagen y vídeo en una sola arquitectura. Admite extensiones de escena de hasta 40 segundos, control del primer/último fotograma, borradores 360p y escalado 4K.

¿Gemini Omni es gratis?

Parcialmente. Gemini Omni Flash es gratis en la capa gratuita de Google Flow, en YouTube Shorts y en la app YouTube Create. Para usar Omni dentro de la app independiente de Gemini se necesita un plan de pago Google AI Plus, Pro o Ultra.

¿Cuánto cuesta Gemini Omni?

Google AI Plus empieza en torno a 7,99 USD/mes, AI Pro es el plan más habitual para creadores y AI Ultra ronda los 100 USD/mes. Dos generaciones de Omni Flash consumen alrededor del 86% de la cuota diaria de AI Pro, así que planifica los reintentos. La API para desarrolladores llegará con su propio precio.

¿Cuándo se lanzará?

Ya está disponible. Google anunció Gemini Omni en el escenario principal de Google I/O 2026 el 19 de mayo de 2026, publicando simultáneamente la página de producto oficial y los vídeos demo.

¿Cómo se relaciona con Veo 3.1?

Gemini Omni es el sucesor de Veo dentro de la app Gemini — Google indica explícitamente que "Omni reemplazará a Veo en la app Gemini". El vídeo se integra ahora en la misma arquitectura que el texto y la imagen de Gemini.

¿Genera sonido directamente?

Sí. Sonido ambiente, banda sonora y diálogo se producen en la misma pasada que el vídeo — esa es la razón del nombre "omni".

¿Cuál es el límite de duración?

Los clips individuales duran hasta 10 segundos, con extensiones de escena que permiten hasta 40 segundos en total (incrementos de 10 segundos). Admite audio nativo, hasta 5 referencias fotográficas, referencias de vídeo de hasta 3 segundos y edición multi-turno. Borrador en 360p o escalado a 4K.

¿Cómo será el precio?

Gemini Omni requiere una suscripción Google AI Plus, Pro o Ultra y tener 18+. Algunas funciones (avatares, edición vídeo a vídeo) pueden estar restringidas en ciertos países.

¿Qué es el avatar de IA de Gemini Omni?

Es una versión digital opcional de ti que permite generar vídeos que se parecen y suenan como tú, sin tener que subir fotos cada vez — y solo tú puedes usar tu propio avatar.