Native Multimodal-Ausgabe
Ein Prompt liefert passenden Text, Keyframes und Video — Charaktere, Stil und Licht bleiben über alle Formate konsistent.
Gemini Omni 1.1 Flash startete am 27. August 2026 — Googles produktionsreifes Update mit Szenenerweiterungen bis zu 40 Sekunden, Erst- und Letztbild-Steuerung, 360p-Entwurfsmodus, 4K-Upscaling und Video-Referenzen. Es ersetzt Veo in der Gemini-App und ist über Google Flow, YouTube Shorts, Google Vids, Google AI Studio und Gemini Enterprise Agent Platform verfügbar.
Alle Clips unten sind direkt von der offiziellen Gemini-Omni-Produktseite eingebettet: Text→Video, Image→Video, Style-Transfer, Chat-Editing, Video→Video und KI-Avatar — die gesamte Feature-Oberfläche.
Alle Demo-Videos © Google, hier zur Informationsbündelung genutzt; direkt von storage.googleapis.com/gweb-gemini-cdn gestreamt.
Offizielles Hero-Video von Gemini Omni: Video per Konversation erstellen, remixen und editieren.
Ein einziger Text-Prompt erzeugt einen Multi-Shot-Clip mit stimmigem Setting und Kamerasprache.
Lade Referenzbilder hoch, Omni übernimmt die Bewegung und füllt die Timeline automatisch.
Hintergrund, Kostüm oder Stil tauschen — dein Subjekt behält seine Details.
Bestehende Aufnahme in einen neuen Stil überführen — Licht, Optik oder Material per Prompt umgeschrieben.
Charaktere tauschen, Licht anpassen, Shots stabilisieren — alles im Chat, ohne Neugenerierung.
KI-Avatar einmal einrichten und in jedem Video auftauchen — ohne Foto-Upload.
Anders als spezialisierte Video-Modelle wie Veo, Sora 2, Seedance 2.0 oder Kling vereint Gemini Omni Sprachverständnis, Bildgenerierung, Videogenerierung und Audio-Synthese in einer Architektur.
Ein Prompt liefert passenden Text, Keyframes und Video — Charaktere, Stil und Licht bleiben über alle Formate konsistent.
Schluss mit dem Verketten spezialisierter Modelle. Text, Bild, Video und Audio teilen sich dieselben Gewichte und denselben langen Kontext.
Ambiente, Score und Dialog richten sich im selben Forward-Pass am Bild aus — Schritte auf dem Beat, Lippen passen ab dem ersten Export.
Objekte tauschen, Licht ändern, Kamerafahrt anpassen — alles in natürlicher Sprache, ohne Neugenerierung, im Stil von Nano Banana.
Bestehenden Clip hochladen und per Prompt umsteuern. Referenzbilder, -videos und -audios lassen sich in einem einzigen Befehl kombinieren.
Integrierte Templates für Produktwerbung, Reels, Musikvideos und Kurzfilme senken die Einstiegshürde und sichern konsistente Bildsprache.
Die Werte folgen Googles Produktions-Launch vom 27. August 2026 von gemini-omni-1.1-flash. Verfügbar über Google AI Studio und Gemini Enterprise Agent Platform.
| Dimension | Bekannte Information |
|---|---|
| Modellfamilie | Google Gemini Omni — 1.1 Flash ist das produktionsreife Release |
| Modell-ID | gemini-omni-1.1-flash |
| Cliplänge | Bis zu 10 Sekunden pro Generierung · bis zu 40 Sekunden mit Szenenerweiterungen (10-Sekunden-Schritte) |
| Auflösung | 360p Entwurf · 720p Standard · 1080p · 4K-Upscaling |
| Seitenverhältnisse | 16:9, 9:16, 1:1 |
| Audio | Natives synchrones Audio in der Ausgabe · API-Audio-Referenzen noch nicht unterstützt |
| Eingaben | Text / Bild / Video (API-Audio-Referenz noch nicht unterstützt) |
| Zugriff | Gemini-App, Google Flow, YouTube Shorts/Create, Google Vids · Entwickler via Gemini API, Google AI Studio und Gemini Enterprise Agent Platform |
| API-Preis | 0,10 $ pro Sekunde Videoausgabe (wie Veo 3.1 Fast) |
Googles generativer Stack war bislang in Veo (Video), Nano Banana / Imagen (Bild) und Gemini (Text) aufgeteilt. Omni führt sie in einer Architektur zusammen.
Vorher
Veo 3.1
Video + nativer Audio
Nano Banana / Imagen
Bildgenerierung und -bearbeitung
Gemini 2.5 / 3.x
Reasoning · langer Kontext
Jetzt · Omni
Gemini Omni
Text · Bild · Video · Audio, ein Modell, ein Prompt
Ein vereintes Modell mit langem Kontext und synchronem Audio heißt: Ein kohärenter Brief, ein fertiger Schnitt — ohne Tool-Wechsel.
Hero-Shots, Packaging-Reveals und Lifestyle-Schnitte mit bereits eingebettetem Ambient-Sound.
Vertikale 9:16-Clips mit On-Mic-Dialog und beat-synchroner Bewegung — perfekt für Social.
Track referenzieren, Omni schneidet auf den Beat und hält Charaktere über Shots konsistent.
Mehrere 10-Sekunden-Omni-Clips zu Multi-Shot-Sequenzen verketten — Licht und Audio-Bett bleiben durchgängig.
Loopbare 16:9-Atmosphäre für SaaS, Fashion und DTC — gebrandet und stumm lesbar.
Skript in narrierte Sequenz mit lippensynchronem Dialog und passendem Ambient-Sound umwandeln.
Aggregiert aus Artificial Analysis, Looksy AI, Oimi AI und offiziellen Keynotes — als Orientierung, nicht als Benchmark.
| Modell | Anbieter | Architektur | Nativer Audio | Cliplänge |
|---|---|---|---|---|
| Gemini Omni
Omni
| Vereinter Omni (Video + Bild + Audio) | In einem Pass synchron | 10s · bis zu 40s | |
| Veo 3.1 | Spezialisiertes Video-Modell | Ja | ~8s | |
| Seedance 2.0 | ByteDance | Spezialisiertes multimodales Video | Ja | bis 15s / Shot |
| Sora 2 | OpenAI | Spezialisiertes Video-Modell | Ja | ~20s |
| Kling V3.0 | Kuaishou | Spezialisiertes Video-Modell | Eingeschränkt | ~10s |
Gemini Omni Flash ist im kostenlosen Tarif von Google Flow, in YouTube Shorts und der YouTube-Create-App kostenlos. Die eigenständige Gemini-App benötigt Google AI Plus, Pro oder Ultra. Hier sind die offiziellen Einstiege.
Googles KI-Filmstudio. Der kostenlose Tarif enthält Gemini Omni Flash mit Nutzungslimits; für höhere Limits und Profi-Tools auf Plus / Pro / Ultra upgraden.
ÖffnenErstelle Gemini-Omni-Flash-Clips direkt in Shorts ohne Kosten. Der günstigste offizielle Weg, Omni gratis auszuprobieren.
ÖffnenMobile Editor-App mit eingebautem Gemini Omni Flash. Kein KI-Abo erforderlich.
ÖffnenOmni in der offiziellen Gemini-App nutzen. Erfordert Google AI Plus, Pro oder Ultra.
ÖffnenSchnellster Gratis-Weg: Melde dich bei YouTube Shorts oder in der YouTube-Create-App an, wähle eine Vorlage und nutze die gleichen Multi-Shot-Prompts wie in der Gemini-App.
Gratis-Kontingente und Preise ändern sich je nach Region und Konto. Aktuelle Infos immer auf den offiziellen Seiten oben prüfen.
Nach öffentlichem Berichtsdatum sortiert. Aktualisiert bis zum Produktions-Launch von Omni 1.1 Flash am 27. August 2026.
X-User @Thomas16937378 entdeckt "Start with an idea or try a template. Powered by Omni." im Gemini-Video-Tab.
TestingCatalog und Chetaslua zeigen die "Meet our new video model"-Karte, die volle Modell-ID und die 10-Sekunden-Grenze.
Ein Clip mit "Professor löst Trigonometrie an der Tafel" zeigt Textkohärenz und physikalische Treue und löst breite Vergleiche mit Veo 3.1 aus.
Google enthüllt Gemini Omni auf der I/O-2026-Mainstage, veröffentlicht die offizielle Produktseite mit Demo-Videos und beginnt, Veo 3.1 in der Gemini-App zu ersetzen.
Mit dem Launch kommen ein persönlicher KI-Avatar, Video→Video-Editing und chatbasiertes Multi-Turn-Editing — Verfügbarkeit je nach Land und Abostufe.
Modell-ID gemini-omni-flash-preview landet in Google AI Studio, Gemini API und Gemini Enterprise Agent Platform zu 0,10 $ pro Sekunde Videoausgabe — gleicher Satz wie Veo 3.1 Fast. Konversationelles Editing und multimodale Referenzen (Text, Bild, Video) unterstützt; API-Audio-Referenzen noch nicht.
Modell-ID gemini-omni-1.1-flash wird produktionsreif über Google AI Studio und Gemini Enterprise Agent Platform. Neue Funktionen: Szenenerweiterungen bis zu 40 Sekunden, Erst- und Letztbild-Spezifikation, 360p-Entwurfsmodus (60 % schneller, 1/3 Kosten), 4K-Upscaling und Video-Referenzen. Integriert von Adobe Firefly, Figma Weave, Runway und mehr.
Google hat ein breiteres Rollout von Gemini Omni Pro über die Ultra-Vorschau hinaus angekündigt, zusammen mit Bild- und Audio-Ausgabe-Modalitäten jenseits des aktuellen videozentrierten Launches — das vollständige Versprechen „jede Eingabe → jede Ausgabe".
Gemini Omni ist Googles vereinte multimodale Familie. Das Produktionsmodell ist Gemini Omni 1.1 Flash (gemini-omni-1.1-flash), das in einer Architektur Video mit nativem synchronem Audio aus Text-, Bild- und Videoeingaben erzeugt. Es unterstützt Szenenerweiterungen bis zu 40 Sekunden, Erst-/Letztbild-Steuerung, 360p-Entwürfe und 4K-Upscaling.
Teilweise. Gemini Omni Flash ist im kostenlosen Tarif von Google Flow, in YouTube Shorts und der YouTube-Create-App kostenlos. Für Omni in der eigenständigen Gemini-App ist ein bezahlter Google-AI-Plus-, Pro- oder Ultra-Plan erforderlich.
Google AI Plus startet bei rund 7,99 US-Dollar pro Monat, AI Pro ist der gängigste Creator-Tarif, AI Ultra liegt bei etwa 100 US-Dollar pro Monat. Zwei Omni-Flash-Generierungen verbrauchen rund 86 % des Tageskontingents von AI Pro, plane Retries entsprechend. Die Entwickler-API kommt mit eigener Preisstruktur.
Bereits erschienen. Google hat Gemini Omni am 19. Mai 2026 auf der Google-I/O-2026-Mainstage angekündigt und parallel die offizielle Produktseite samt Demo-Videos veröffentlicht.
Gemini Omni ist der Nachfolger von Veo in der Gemini-App — Google sagt ausdrücklich, dass „Omni Veo in der Gemini-App ersetzen wird“. Video läuft jetzt in derselben Architektur wie Geminis Text und Bild.
Ja. Ambiente, Score und Dialog werden im selben Pass wie das Video erzeugt — genau dafür steht das "omni" im Namen.
Einzelne Clips sind bis zu 10 Sekunden lang, mit Szenenerweiterungen bis zu 40 Sekunden insgesamt (10-Sekunden-Schritte). Unterstützt natives Audio, bis zu 5 Foto-Referenzen, Video-Referenzen bis zu 3 Sekunden und Multi-Turn-Editing. Entwurf in 360p oder Upscaling auf 4K.
Gemini Omni benötigt ein Google-AI-Plus-, Pro- oder Ultra-Abo und ein Mindestalter von 18 Jahren. Einzelne Features (Avatar, Video→Video-Editing) können je nach Land eingeschränkt sein.
Eine optionale digitale Version von dir, mit der Gemini Videos erzeugt, die wie du aussehen und klingen — ohne jedes Mal neue Fotos hochzuladen. Nur du selbst kannst deinen Avatar nutzen.
Alle Inhalte hier sind aus den unten genannten öffentlichen Quellen aggregiert. Querlesen empfohlen.
Offizieller Announcement-Beitrag zu Omni Flash – Launch, Funktionen, Oberflächen und Rollout-Plan.
Vollständige I/O 2026 Zusammenfassung zu Gemini Omni, dem neuen 100-$-AI-Ultra-Tarif und den umgebenden Launches.
Offizielle Launch-Seite mit Demo-Videos, Funktionsübersicht, unterstützten Abos und Rollout-Details.
Unabhängige Analystenübersicht, wie Omni den Veo- und Imagen-Stack zu einem Modell fusioniert und was jetzt vs. später kommt.
Leak-Details, UI-Strings und frühe Demo-Analysen.
Volle Modell-ID, In-App-Prompts und Community-Reaktionen.
Zusammenfassung von Specs, Use-Cases und Vergleichen.
Multimodale Fähigkeiten der Familie, langer Kontext und agentische Richtung.