ネイティブなマルチモーダル出力
1 つのプロンプトでテキスト・キーフレーム・動画を同時生成。キャラクター・スタイル・ライティングが各フォーマット間で一貫します。
2026 年 8 月 27 日、Google が Gemini Omni 1.1 Flash を正式リリース — シーン延長で最大 40 秒、首尾フレーム指定、360p ドラフトモード、4K アップスケール、動画リファレンスに対応した本番環境向けアップデート。Gemini アプリ内で Veo を置き換え、Google Flow、YouTube Shorts、Google Vids、Google AI Studio、Gemini Enterprise Agent Platform で利用可能。
以下の動画はすべて Google 公式 Gemini Omni 製品ページから直接埋め込まれています。テキスト→動画、画像→動画、スタイル転送、チャット編集、動画→動画、AI アバターまでの主要能力をカバーします。
デモ動画の著作権は Google に帰属します。情報集約目的で storage.googleapis.com/gweb-gemini-cdn から直接配信しています。
Gemini Omni のメインヒーロー動画:会話で動画を生成・リミックス・編集。
1 行のテキストプロンプトから、一貫した環境とカメラワークを備えた複数ショットの映像を生成。
参照画像をアップロードすれば Omni が動きを補完し、タイムラインを自動で埋めます。
背景や衣装の入れ替え、スタイル転送を行っても被写体のディテールが維持されます。
既存の映像を新しいスタイルへ再構成。ライト、レンズ、素材感までプロンプトで書き換え。
キャラ差し替え、ライティング調整、手ブレ補正——再生成なしでチャットだけで完結。
AI アバターを 1 度設定するだけで、写真を再アップしなくても自分が出演できます。
Veo / Sora 2 / Seedance 2.0 / Kling などの専用動画モデルとは異なり、Gemini Omni は言語推論・画像生成・動画生成・音声合成を同じアーキテクチャに収めます。
1 つのプロンプトでテキスト・キーフレーム・動画を同時生成。キャラクター・スタイル・ライティングが各フォーマット間で一貫します。
専用モデルを連結する必要はもうありません。テキスト・画像・動画・音声が同じ重みと長いコンテキストを共有します。
環境音・スコア・対話が映像と同じフォワードパス内で揃えられます。足音は拍に乗り、口の動きは初回エクスポートからスピーチと合います。
自然言語でオブジェクトの差し替え・ライティング変更・カメラワーク調整が可能。Nano Banana の編集思想を踏襲し、再生成不要。
既存クリップをアップロードしプロンプトで方向修正。参照画像・動画・音声を 1 つの指示にまとめられます。
製品広告・Reels・MV・シネマティック短編の組み込みテンプレで初心者の敷居を下げ、カメラ言語の一貫性を保ちます。
以下の数値は Google の 2026 年 8 月 27 日本番リリース gemini-omni-1.1-flash に基づきます。Google AI Studio と Gemini Enterprise Agent Platform から利用可能。
| 項目 | 判明している情報 |
|---|---|
| モデルファミリー | Google Gemini Omni — 1.1 Flash が本番環境対応の正式リリース |
| モデル ID | gemini-omni-1.1-flash |
| クリップ長 | 1 回の生成で最大 10 秒 · シーン延長で最大 40 秒(10 秒単位) |
| 解像度 | 360p ドラフト · 720p 標準 · 1080p · 4K アップスケール |
| アスペクト比 | 16:9、9:16、1:1 |
| 音声 | 出力にネイティブ同期音声 · API 音声参照は未対応 |
| 入力 | テキスト / 画像 / 動画(API 音声参照は未対応) |
| アクセス | Gemini アプリ、Google Flow、YouTube Shorts/Create、Google Vids · 開発者は Gemini API、Google AI Studio、Gemini Enterprise Agent Platform 経由 |
| API 料金 | 動画出力 $0.10 / 秒(Veo 3.1 Fast と同額) |
Google の生成系スタックはこれまで Veo(動画)、Nano Banana / Imagen(画像)、Gemini(テキスト)に分かれていました。Omni はこれらを 1 つのアーキテクチャにまとめます。
以前
Veo 3.1
動画 + ネイティブ音声
Nano Banana / Imagen
画像生成と編集
Gemini 2.5 / 3.x
推論 · 長コンテキスト
現在 · Omni
Gemini Omni
テキスト · 画像 · 動画 · 音声、1 モデル 1 プロンプト
統合モデル + 長コンテキスト + 同期音声により、1 つの一貫したブリーフで完成した編集物まで一気通貫で制作できます。
ヒーローショット、パッケージ公開、ライフスタイルカットを環境音とともに納品。
マイクオン対話とビート同期モーションを備えた 9:16 縦型クリップ。SNS 滞在向け。
トラックを参照すれば Omni がビートに合わせて編集、複数ショットで人物の一貫性を維持。
10 秒の omni-clip を複数つなぎ、連続したライティング・人物・音床を保ちます。
SaaS / ファッション / DTC 向けのループ可能な 16:9 雰囲気素材、ブランド色と無音耐性込み。
台本をリップシンク付きナレーション映像に変換し、環境音設計も一致。
Artificial Analysis、Looksy AI、Oimi AI、公式発表からの集約。ベンチマークではなく方向性の把握用。
| モデル | 提供元 | アーキテクチャ | ネイティブ音声 | クリップ長 |
|---|---|---|---|---|
| Gemini Omni
Omni
| 統合 Omni(動画 + 画像 + 音声) | ワンパス同期 | 10s · 最大40s | |
| Veo 3.1 | 専用動画モデル | 対応 | 約 8s | |
| Seedance 2.0 | ByteDance | 専用マルチモーダル動画 | 対応 | 最大 15s / ショット |
| Sora 2 | OpenAI | 専用動画モデル | 対応 | 約 20s |
| Kling V3.0 | Kuaishou | 専用動画モデル | 限定的 | 約 10s |
Gemini Omni Flash は Google Flow の無料プラン、YouTube Shorts、YouTube Create アプリで無料です。単体の Gemini アプリには Google AI Plus / Pro / Ultra が必要です。下記の公式入口からすぐに試せます。
Google の AI 映像制作スタジオ。無料プランでも利用上限付きで Gemini Omni Flash を使えます。上限拡大やプロ向け機能は Plus / Pro / Ultra で。
開くShorts 内で Gemini Omni Flash クリップを完全無料で生成。最も安く公式に Omni を体験できる経路。
開くモバイル向け編集アプリに Gemini Omni Flash を内蔵。AI サブスク不要。
開く公式 Gemini アプリで Omni を利用。Google AI Plus・Pro・Ultra のいずれかが必要。
開く最短の無料ルート:YouTube Shorts または YouTube Create アプリにログインし、テンプレートを選んで Gemini アプリと同じマルチショット型プロンプトで生成します。
無料枠と価格は地域・アカウントで変わります。常に上記の公式ページで最新情報を確認してください。
公開報道日順。2026 年 8 月 27 日の Omni 1.1 Flash 本番リリースまで更新。
X ユーザー @Thomas16937378 が Gemini 動画タブ内で "Start with an idea or try a template. Powered by Omni." を発見。
TestingCatalog と Chetaslua が "Meet our new video model" カード、完全モデル ID、10 秒上限を確認。
"黒板で三角関数を解く教授" のクリップがテキスト一貫性と物理的忠実度を示し、Veo 3.1 との比較が活発化。
Google が I/O 2026 のメインステージで Gemini Omni を発表。公式製品ページと公式デモ動画を同時公開し、Gemini アプリ内で Veo 3.1 の置換が始まりました。
正式版にはパーソナル AI アバター、動画→動画編集、チャット式マルチターン編集が同梱。地域とサブスクリプション階層により段階的に有効化されます。
モデル ID gemini-omni-flash-preview が Google AI Studio、Gemini API、Gemini Enterprise Agent Platform に登場。動画出力 $0.10 / 秒 — Veo 3.1 Fast と同額。会話型編集とマルチモーダル参照(テキスト、画像、動画)に対応;API 音声参照は未対応。
モデル ID gemini-omni-1.1-flash が Google AI Studio と Gemini Enterprise Agent Platform 経由で本番環境対応に。新機能:シーン延長で最大 40 秒、首尾フレーム指定、360p ドラフトモード(60% 高速、コスト 1/3)、4K アップスケール、動画リファレンス。Adobe Firefly、Figma Weave、Runway などに統合。
Google は Ultra プレビューを超えて Gemini Omni Pro の広域ロールアウトを発表し、現在の動画優先リリースを超えて画像・音声出力モダリティを追加 — 「任意の入力 → 任意の出力」の完全な約束を実現。
Gemini Omni は Google の統合マルチモーダルファミリーです。本番モデルは Gemini Omni 1.1 Flash(gemini-omni-1.1-flash)で、1 つのアーキテクチャ内でテキスト・画像・動画入力からネイティブ同期音声付き動画を生成します。シーン延長で最大 40 秒、首尾フレーム指定、360p ドラフト、4K アップスケールに対応。
一部無料です。Gemini Omni Flash は Google Flow の無料プラン、YouTube Shorts、YouTube Create アプリで無料で使えます。単体の Gemini アプリで Omni を使うには Google AI Plus / Pro / Ultra の有料プランが必要です。
Google AI Plus は月額約 7.99 米ドルから、AI Pro はクリエイター向けの主流プラン、AI Ultra は月額約 100 米ドルです。AI Pro では Omni Flash の生成 2 回で当日の枠の約 86% を消費するため、リトライは慎重に。開発者向け API は別途料金が告知される予定です。
既にリリース済みです。2026 年 5 月 19 日に Google I/O 2026 メインステージで Gemini Omni が正式発表され、公式製品ページとデモ動画が同時公開されました。
Gemini Omni は Gemini アプリにおける Veo の後継です。Google は「Omni が Gemini アプリ内で Veo を置き換える」と明言しており、動画機能は Gemini のテキスト・画像と同じアーキテクチャに統合されました。
はい。環境音・スコア・対話が動画と同じパスで生成されます。それが "omni" という名称の理由でもあります。
単一クリップは最大 10 秒、シーン延長で最大 40 秒まで(10 秒単位)。ネイティブ音声、最大 5 枚の写真リファレンス、最大 3 秒の動画リファレンス、マルチターン編集に対応。360p でドラフトまたは 4K にアップスケール可能。
Gemini Omni の利用には Google AI Plus / Pro / Ultra プランと 18 歳以上であることが必要です。アバターや動画→動画編集など一部機能は地域によって利用できない場合があります。
オプションのデジタル分身です。一度設定すれば、写真を毎回アップロードしなくても自分のように見えて聞こえる動画を生成でき、自分のアバターを使えるのは本人のみです。
このページの内容は以下の公開ソースを集約したものです。複数ソースの確認を推奨します。
Omni Flash の発表、機能、提供面、ロールアウト計画を詳述した公式アナウンス記事。
Gemini Omni、新しい $100 の AI Ultra プラン、周辺の発表を含む I/O 2026 完全レビュー。
公式ローンチページ。デモ動画、機能ツアー、対応プラン、展開状況など一次情報源。
Omni が Veo と Imagen のスタックを単一モデルに統合した仕組みと、現在提供中・今後提供予定の機能を独立アナリストが整理。
リーク詳細、UI 文字列、初期デモ分析。
完全モデル ID、アプリ内プロンプト、コミュニティ反応。
仕様、ユースケース、比較のまとめ。
Gemini ファミリーのマルチモーダル能力、長コンテキスト、エージェント方向性。