Нативный мультимодальный вывод
Один промпт даёт согласованные текст, ключевые кадры и видео — персонажи, стиль и свет сохраняются во всех форматах.
Gemini Omni 1.1 Flash вышел 27 августа 2026 года — production-ready обновление Google с расширениями сцен до 40 секунд, контролем первого и последнего кадра, режимом черновика 360p, апскейлом 4K и видео-референсами. Заменяет Veo в приложении Gemini и доступен в Google Flow, YouTube Shorts, Google Vids, Google AI Studio и Gemini Enterprise Agent Platform.
Все ролики ниже встроены напрямую с официальной страницы Gemini Omni: text→video, image→video, перенос стиля, редактирование в чате, video→video и AI-аватар — вся поверхность возможностей.
Все демо-видео © Google, используются здесь исключительно для информационной агрегации; стрим напрямую с storage.googleapis.com/gweb-gemini-cdn.
Главное hero-видео Gemini Omni: создание, ремикс и редактирование видео через диалог.
Один текстовый промпт даёт мульти-кадровый клип со связной средой и языком камеры.
Загрузите референсные изображения — Omni возьмёт на себя движение и сам заполнит таймлайн.
Меняйте фон, костюм или стиль — субъект сохраняет свои детали.
Переписать существующий план в новом стиле — свет, оптика и даже материал управляются промптом.
Меняйте персонажей, свет и стабилизацию кадров — всё в чате, без повторной генерации.
Настройте AI-аватар один раз — и снимайтесь в каждом видео без загрузки фото.
В отличие от специализированных видеомоделей вроде Veo, Sora 2, Seedance 2.0 или Kling, Gemini Omni удерживает рассуждение, генерацию изображений, генерацию видео и синтез звука в одной архитектуре.
Один промпт даёт согласованные текст, ключевые кадры и видео — персонажи, стиль и свет сохраняются во всех форматах.
Больше не нужно соединять специализированные модели. Текст, изображение, видео и аудио делят те же веса и тот же длинный контекст.
Эмбиент, музыка и диалог выравниваются с картинкой в том же проходе — шаги попадают в бит, губы синхронизируются с речью с первого экспорта.
Замените объект, измените освещение, поправьте движение камеры на естественном языке — без повторной генерации, в духе Nano Banana.
Загрузите существующий клип и перенаправьте его промптами. Опорные изображения, видео и звуки сочетаются в одной инструкции.
Встроенные шаблоны для рекламы продукта, Reels, музыкальных клипов и кинематографичных короткометражек снижают порог входа и удерживают единый язык кадра.
Цифры ниже соответствуют production-запуску Google от 27 августа 2026 для gemini-omni-1.1-flash. Доступно через Google AI Studio и Gemini Enterprise Agent Platform.
| Параметр | Известная информация |
|---|---|
| Семейство | Google Gemini Omni — 1.1 Flash это production-ready релиз |
| ID модели | gemini-omni-1.1-flash |
| Длина клипа | До 10 секунд за генерацию · до 40 секунд с расширениями сцен (шаг 10 секунд) |
| Разрешение | 360p черновик · 720p стандарт · 1080p · апскейл 4K |
| Соотношения сторон | 16:9, 9:16, 1:1 |
| Аудио | Нативное синхронизированное аудио на выходе · аудио-референсы в API пока не поддерживаются |
| Входы | Текст / изображение / видео (аудио-референс в API пока не поддерживается) |
| Доступ | Приложение Gemini, Google Flow, YouTube Shorts/Create, Google Vids · разработчики через Gemini API, Google AI Studio и Gemini Enterprise Agent Platform |
| Цены API | $0,10 за секунду видеовыхода (как у Veo 3.1 Fast) |
Генеративный стек Google ранее делился на Veo (видео), Nano Banana / Imagen (изображения) и Gemini (текст). Omni объединяет их в единую архитектуру.
Раньше
Veo 3.1
Видео + нативное аудио
Nano Banana / Imagen
Генерация и редактирование изображений
Gemini 2.5 / 3.x
Рассуждение · длинный контекст
Сейчас · Omni
Gemini Omni
Текст · изображение · видео · аудио, одна модель, один промпт
Единая модель + длинный контекст + синхронный звук означают: можно написать связный бриф и сразу получить готовый монтаж.
Hero-кадры, раскрытие упаковки и lifestyle-сцены с уже встроенным эмбиентом.
Вертикальные клипы 9:16 с диалогом on-mic и движением в бит — для удержания внимания в ленте.
Дайте трек как референс — Omni режет видео в бит и сохраняет персонажа в нескольких кадрах.
Сцепите несколько 10-секундных omni-clip в мультикадровые сцены с непрерывным светом и звуковой подложкой.
Зацикливаемые 16:9 атмосферные ролики для SaaS, fashion и DTC — с брендингом и читаемостью без звука.
Превратите скрипт в нарратив с lip-sync диалогом и соответствующим эмбиентом.
Сводка по Artificial Analysis, Looksy AI, Oimi AI и официальным презентациям — для ориентира, а не бенчмарка.
| Модель | Разработчик | Архитектура | Нативное аудио | Длина клипа |
|---|---|---|---|---|
| Gemini Omni
Omni
| Единый Omni (видео + изображение + аудио) | Синхронизация за один проход | 10s · до 40s | |
| Veo 3.1 | Специализированная видео-модель | Да | ~8s | |
| Seedance 2.0 | ByteDance | Специализированное мультимодальное видео | Да | до 15s / план |
| Sora 2 | OpenAI | Специализированная видео-модель | Да | ~20s |
| Kling V3.0 | Kuaishou | Специализированная видео-модель | Ограничено | ~10s |
Gemini Omni Flash бесплатен на бесплатном тарифе Google Flow, в YouTube Shorts и приложении YouTube Create. Отдельному приложению Gemini нужен Google AI Plus, Pro или Ultra. Откройте официальные входы ниже.
ИИ-киностудия Google. Бесплатный тариф включает Gemini Omni Flash с лимитами; для более высоких лимитов и профи-инструментов перейдите на Plus / Pro / Ultra.
ОткрытьСоздавайте клипы Gemini Omni Flash в Shorts без оплаты. Самый дешёвый официальный способ попробовать Omni бесплатно.
ОткрытьМобильный редактор со встроенным Gemini Omni Flash. Подписка на ИИ не нужна.
ОткрытьИспользуйте Omni внутри официального приложения Gemini. Нужен план Google AI Plus, Pro или Ultra.
ОткрытьСамый быстрый бесплатный путь: войдите в YouTube Shorts или приложение YouTube Create, выберите шаблон и используйте те же многоплановые промпты, что и в приложении Gemini.
Бесплатные квоты и цены зависят от региона и аккаунта. Всегда сверяйтесь с официальными входами выше.
Отсортировано по дате публичного репорта. Обновлено до production-запуска Omni 1.1 Flash от 27 августа 2026.
Пользователь X @Thomas16937378 заметил строку "Start with an idea or try a template. Powered by Omni." во вкладке видео Gemini.
TestingCatalog и Chetaslua показали карточку "Meet our new video model", полный ID модели и ограничение в 10 секунд.
Клип "профессор решает тригонометрию на доске" продемонстрировал согласованность текста и физическую достоверность, разогнав сравнения с Veo 3.1.
Google представляет Gemini Omni на основной сцене I/O 2026, публикует официальную страницу продукта с демо-видео и начинает замену Veo 3.1 внутри приложения Gemini.
Релиз включает личный AI-аватар, редактирование video→video и многошаговое редактирование в чате — доступность зависит от страны и уровня подписки.
ID модели gemini-omni-flash-preview появляется в Google AI Studio, Gemini API и Gemini Enterprise Agent Platform по $0,10 за секунду видеовыхода — та же ставка, что у Veo 3.1 Fast. Поддерживаются диалоговое редактирование и мультимодальные референсы (текст, изображение, видео); аудио-референсы в API пока нет.
ID модели gemini-omni-1.1-flash становится production-ready через Google AI Studio и Gemini Enterprise Agent Platform. Новые возможности: расширения сцен до 40 секунд, спецификация первого и последнего кадра, режим черновика 360p (на 60% быстрее, 1/3 стоимости), апскейл 4K и видео-референсы. Интегрирован Adobe Firefly, Figma Weave, Runway и другими.
Google объявил о более широком rollout Gemini Omni Pro за пределами Ultra preview, вместе с модальностями вывода изображения и аудио помимо текущего video-first запуска — полное обещание «любой вход → любой выход».
Gemini Omni — единое мультимодальное семейство Google. Production-модель — Gemini Omni 1.1 Flash (gemini-omni-1.1-flash), которая генерирует видео с нативным синхронизированным аудио из текстовых, изображенческих и видеовходов в одной архитектуре. Поддерживает расширения сцен до 40 секунд, контроль первого/последнего кадра, черновики 360p и апскейл 4K.
Частично. Gemini Omni Flash бесплатен на бесплатном тарифе Google Flow, в YouTube Shorts и приложении YouTube Create. Чтобы использовать Omni в отдельном приложении Gemini, нужен платный план Google AI Plus, Pro или Ultra.
Google AI Plus стартует примерно с 7,99 USD/мес, AI Pro — самый распространённый план у криэйторов, AI Ultra — около 100 USD/мес. Две генерации Omni Flash расходуют около 86% дневной квоты AI Pro, планируйте повторы. API для разработчиков выйдет с собственной ценой.
Уже вышел. 19 мая 2026 года Google объявил Gemini Omni на основной сцене Google I/O 2026 и одновременно опубликовал официальную страницу продукта и демо-видео.
Gemini Omni — преемник Veo внутри приложения Gemini. Google прямо говорит, что "Omni заменит Veo в приложении Gemini". Видео теперь работает в той же архитектуре, что текст и изображения Gemini.
Да. Эмбиент, музыка и диалог производятся в том же проходе, что и видео — именно ради этого название "omni".
Отдельные клипы до 10 секунд, с расширениями сцен до 40 секунд суммарно (шаг 10 секунд). Поддерживает нативное аудио, до 5 фото-референсов, видео-референсы до 3 секунд и мультираундное редактирование. Черновик в 360p или апскейл до 4K.
Gemini Omni требует подписки Google AI Plus, Pro или Ultra и возраста 18+. Часть функций (аватары, video→video) может быть недоступна в отдельных странах.
Это опциональная цифровая версия вас. Один раз настроив её, можно генерировать видео, где вы выглядите и звучите как вы сами — без повторной загрузки фото. Вашим аватаром можете пользоваться только вы.
Весь контент собран из публичных источников ниже. Рекомендуется проверять перекрёстно.
Официальный анонс с подробностями запуска Omni Flash, возможностями, поверхностями и планом выкатки.
Полный обзор I/O 2026: Gemini Omni, новый тариф AI Ultra за $100 и сопутствующие релизы.
Официальная страница релиза: демо-видео, обзор возможностей, поддерживаемые подписки и детали раскатки.
Независимый аналитический обзор того, как Omni объединяет стеки Veo и Imagen в одной модели, и что доступно сейчас и в будущем.
Детали утечки, UI-строки и разбор ранних демо.
Полный ID модели, in-app промпты и реакции сообщества.
Краткая сводка спецификаций, кейсов и сравнений.
Мультимодальные возможности семейства, длинный контекст и агентное направление.