Gemini Omni en agosto de 2026: beta privada de la API, avance de Omni Pro y nuevas funciones
Tres meses después de I/O: la API de Gemini Omni Flash abre beta privada en Google AI Studio y Vertex AI, Omni Pro previsualiza clips de 30 segundos, Google Flow añade controles de línea de tiempo y se aclara la tarificación de la segunda mitad de 2026.
Tres meses después de Google I/O
Gemini Omni se lanzó en Google I/O el 19 de mayo de 2026. Tres meses después, el panorama ha cambiado de forma notable: la API para desarrolladores ya no es una promesa vaga, Gemini Omni Pro tiene una vista previa concreta y Google Flow ha incorporado los controles creativos que los usuarios avanzados pedían desde el primer día.
Esta publicación es el balance de agosto de 2026: acceso a la API, adelanto del nivel Pro, mejoras en Flow y la app Gemini, y el modelo de precios actualizado de cara a la segunda mitad del año.
Estado de la API para desarrolladores: beta privada activa
La mayor noticia de ingeniería del verano: Google abrió una beta privada de la API de Gemini Omni Flash a través de Google AI Studio y Vertex AI. Aún no es un despliegue GA público: el acceso se limita a socios empresariales y desarrolladores aprobados que se unan a la lista de espera.
Qué obtienen los socios de la beta
- Endpoints:
generateVideo,editVideoygenerateWithAvatar, reflejando lo que los usuarios ya tienen en la app Gemini y Flow. - Límites de tasa: los niveles beta empiezan en 10 operaciones concurrentes y 500 generaciones al día por proyecto, con topes más altos negociables para socios de producción.
- SynthID + C2PA: cada respuesta de la API incluye metadatos de marca de agua obligatorios, alineados con la política de IA responsable de Google.
Señales de precios (no definitivos)
Google aún no ha publicado precios oficiales de la API, pero la documentación para socios beta cita tarifas estimadas de 0,12–0,28 USD por segundo de vídeo generado, según resolución y si el modo avatar está activado. Eso sitúa a Omni Flash de forma competitiva frente a Runway Gen-4 y por debajo de los niveles premium de Veo 3.1 en muchas cargas de trabajo.
Los analistas que modelaron supuestos de I/O en 0,10–0,30 USD/seg ahora tienen cifras reales — aunque Google advierte que pueden cambiar antes del GA.
Lista de espera y calendario
Los desarrolladores individuales pueden solicitar acceso en la lista de espera de la Gemini API. Los equipos empresariales deben contactar a su gestor de cuenta de Google Cloud para Vertex AI. Google apunta a un GA público en otoño de 2026, con límites más amplios y facturación autoservicio.
API Omni frente a Veo 3.1 hoy
| Factor | API Veo 3.1 | API Omni Flash (beta) |
|---|---|---|
| Disponibilidad | Disponibilidad general | Solo beta privada |
| Edición multironda | Regenerar desde cero | Edición conversacional nativa |
| Soporte avatar | No disponible | Integrado |
| Duración máxima del clip | Hasta 8 segundos | Hasta 10 segundos (Flash) |
| Precios | Publicados (0,15–0,40 USD/seg) | Estimados (0,12–0,28 USD/seg) |
Conclusión para desarrolladores: si necesitas acceso API de producción hoy, Veo 3.1 sigue siendo la vía soportada. Si puedes esperar hasta otoño de 2026 — o cumples requisitos para la beta — empieza a diseñar detrás de una interfaz de proveedor. Nuestra guía para desarrolladores de la API detalla el patrón de migración.
Gemini Omni Pro: primera mirada
Google usó agosto para adelantar Gemini Omni Pro, el nivel de mayor capacidad anunciado en I/O pero sin calendario. El acceso anticipado a la vista previa se está desplegando para suscriptores de AI Ultra y socios empresariales selectos de la beta.
Qué añade Pro sobre Flash
| Capacidad | Omni Flash | Omni Pro (vista previa) |
|---|---|---|
| Duración máxima | 10 segundos | Hasta 30 segundos |
| Resolución | 720p | 1080p, 4K en pruebas |
| Audio | Audio nativo sincronizado | Síntesis de audio nativa con sincronización de voces multirrol |
| Consistencia de personaje | Buena entre turnos | Mayor bloqueo de identidad en secuencias más largas |
La demo estrella del briefing de socios de agosto mostró un clip narrativo de 30 segundos con tres roles hablantes distintos — cada uno con su timbre, labios sincronizados con diálogo generado — sin mezcla de audio en postproducción. Es la diferenciación más clara frente a Flash: Pro está pensado para contenido de longitud narrativa, no solo ganchos cortos.
La vista previa de Pro aún no está disponible vía API. Google indica que los endpoints de Pro seguirán al GA de Flash, probablemente a finales de 2026.
Mejoras en Google Flow y la app Gemini
Agosto trajo tres mejoras orientadas al creador cotidiano:
Controles de línea de tiempo en Google Flow
Flow expone ahora una línea de tiempo visual de escenas: arrastra para reordenar planos, recorta segmentos individuales y previsualiza la secuencia completa antes de exportar. Antes, el orden de escenas era solo conversacional; la línea de tiempo ofrece la precisión de un NLE tradicional sin salir del flujo Omni.
Consistencia de personaje en avatares
La función de avatar personal de IA ganó bloqueo de identidad entre escenas: tu likeness digital mantiene apariencia, vestuario y timbre de voz en todo un proyecto multishot, no solo en una generación. Cierra la mayor brecha entre avatares Omni y pipelines profesionales de deepfake.
Ajuste conversacional de voz
En la app Gemini puedes ajustar características de voz a mitad de conversación — «que el narrador suene más cálido» o «dale acento británico al personaje» — y Omni aplica el cambio en la siguiente generación sin romper el contexto de escena.
Estas tres funciones están activas para suscriptores de AI Plus, Pro y Ultra en web y móvil.
Precios actualizados y cuotas basadas en cómputo
Google aclaró la estructura de suscripción de la segunda mitad de 2026 junto con la actualización de agosto:
| Nivel | Mensual | Acceso Omni | Cuota de cómputo |
|---|---|---|---|
| AI Plus | 7,99 USD | Flash en app Gemini + Flow | Límites de entrada, ~actualización cada 5 h |
| AI Pro | 19,99 USD | Más límites Flash + créditos Flow | ~3× Plus, ~actualización cada 5 h |
| AI Ultra | 100 USD | Flash + vista previa Pro, 5× límites Pro | Nivel consumidor más alto |
El modelo de cuota basada en cómputo — introducido en I/O — ya está documentado por completo: tus límites dependen de la complejidad del prompt, la duración del clip y las funciones usadas (avatar, edición multironda, etc.), actualizándose aproximadamente cada cinco horas hasta un tope semanal. Usuarios intensivos de Flow en Plus pueden alcanzar límites antes que usuarios ligeros de la app Gemini en Pro, así que el nivel debe coincidir con tu superficie principal.
YouTube Shorts Remix y YouTube Create siguen siendo gratuitos para mayores de 18 años, sin cambios desde el lanzamiento.
Resumen y hoja de ruta de otoño 2026
Agosto de 2026 marca la transición de «Omni es un producto de consumo» a «Omni es una plataforma». La beta privada de la API, la vista previa de Pro y los controles de línea de tiempo en Flow son los tres pilares.
Qué esperar este otoño:
- GA público de la API Omni Flash — acceso autoservicio vía Gemini API y Vertex AI, con precios publicados.
- Despliegue más amplio de Omni Pro — más allá de la vista previa Ultra, hacia suscriptores Pro, con clips de 30 s y 1080p por defecto.
- Modalidades de salida de imagen y audio — siguen comprometidas, sin fecha, pero Google confirmó pruebas internas en curso.
- Integración con Workspace — despliegue gradual de Omni en Google Docs, Slides y Vids para clientes empresariales.
Para la historia completa del lanzamiento, consulta nuestras notas de lanzamiento de mayo de 2026 y la actualización de junio. Para arquitectura API, la guía para desarrolladores; para la comparación con Veo, Gemini Omni vs Veo 3.1.