Gemini Omni Flash API ist live: Public Preview, 0,10 $/s und was Entwickler wissen sollten
Seit dem 30. Juni 2026 ist gemini-omni-flash-preview in Public Preview auf Gemini API, Google AI Studio und Gemini Enterprise Agent Platform — konversationelles Editing, 10-Sekunden-Deckel und 0,10 $ pro Sekunde Videoausgabe.
Das Warten ist vorbei
Auf der Google I/O 2026 sagte Google, die Entwickler-API für Gemini Omni Flash komme „in den kommenden Wochen“. Am 30. Juni 2026 wurde das Wort gehalten: Die Modell-ID gemini-omni-flash-preview ist in Google AI Studio, der Gemini API und der Gemini Enterprise Agent Platform verfügbar.
Consumer-Oberflächen (Gemini-App, Google Flow, YouTube Shorts / Create) hatten Flash bereits. Dieser Beitrag dreht sich um den Entwickler-Moment — Preise, Limits und was noch nicht bereit ist.
Offizieller Launch-Beitrag: Start building with Nano Banana 2 Lite and Gemini Omni Flash.
Was Sie heute aufrufen können
| Punkt | Wert |
|---|---|
| Modell-ID | gemini-omni-flash-preview |
| Status | Public Preview |
| Preis Videoausgabe | 0,10 $ / Sekunde (wie Veo 3.1 Fast) |
| Max. Cliplänge | 10 Sekunden (längere Dauern folgen) |
| API-Auflösung | 720p |
| Eingaben | Text, Bild, Video |
| Ausgaben | Video (+ Textantworten) |
| Editing | Konversationell, Multi-Turn |
| Herkunft | SynthID-Wasserzeichen + C2PA Content Credentials |
Omni Flash ist das kosteneffiziente Video-Workhorse in der Omni-Familie: multimodale Referenzen, Gemini-grounded Weltwissen und Chat-Edits ohne den ganzen Clip neu zu generieren.
Wo es läuft
Verbraucher
- Gemini-App (Google AI Plus / Pro / Ultra)
- Google Flow
- YouTube Shorts und YouTube Create (kostenlos ab 18)
Entwickler
- Google AI Studio Playground
- Gemini API
- Gemini Enterprise Agent Platform
Preise in der Praxis
Google bepreist Omni-Flash-Videoausgabe mit 0,10 $ pro Sekunde. Ein voller 10-Sekunden-Clip kostet etwa 1,00 $ Ausgabe vor Input-Tokens. Preview-Preise werben derzeit keinen Batch-Rabatt — es gibt auf diesem Modell noch keinen „billiger, wenn Sie warten können“-Hebel.
Consumer-Kontingente folgen weiter den Compute-Limits des Google-AI-Abos. Vermischen Sie die nicht mit API-Abrechnung, wenn Sie Agentur- oder Produkt-Stückkosten modellieren.
Limits, die Sie einplanen sollten
Google ist explizit zu Preview-Einschränkungen:
- 10-Sekunden-Generierungen — harte Produktgrenze vorerst; längere Clips stehen auf der Roadmap.
- Keine API-Audio-Referenzen — Audio-Upload als Referenz wird für dieses Modell in der Gemini API noch nicht unterstützt (Ausgabe kann dennoch natives synchrones Audio tragen).
- Kurze Video-Referenzen sind brüchig — das Schema akzeptiert ggf. Video-Referenzen bis 3 Sekunden, Google weist aber darauf hin, dass sie derzeit nicht korrekt verarbeitet werden.
- Szenenwechsel und Schwenks — Charakterkonsistenz kann über Schnitte hinweg rutschen; planen Sie extra Edit-Turns oder engere Referenzen ein.
Behandeln Sie das als Produktconstraints, nicht als temporäre Support-Tickets.
Omni Flash API vs Veo 3.1
| Faktor | Omni Flash (Preview) | Veo 3.1 |
|---|---|---|
| Architektur | Multimodale Omni-Familie | Spezialisiertes Videomodell |
| Editing | Native konversationelle Edits | Re-Prompt / Regenerieren |
| Preissignal | 0,10 $ / s Ausgabe | Veo Fast ebenfalls 0,10 $ / s; höhere Tiers teurer |
| Cliplänge | Bis 10 s | In Produktionsdocs oft ~8 s |
| Reife | Public Preview | Allgemein verfügbar (GA) |
Wer heute einen stabilen Produktionspfad braucht, setzt weiter auf Veo 3.1. Wer In-Chat-Editing und Omni-artige multimodale Steuerung will, ist Flash Preview die neue Oberfläche. Das saubere Muster bleibt eine VideoProvider-Schnittstelle mit zwei Implementierungen — siehe unseren API-Entwicklerleitfaden für die Migrationsform (vor der Preview geschrieben; dieser Artikel ist das Status-Update).
Kombination mit Bildmodellen
Der 30.-Juni-Post brachte auch Nano Banana 2 Lite für schnelle, günstige Bildentwürfe. Die vorgesehene Schleife ist einfach: Stills schnell generieren oder bearbeiten, dann ein gewähltes Frame als Image-to-Video-Referenz an Omni Flash übergeben. Demo-Apps in AI Studio zeigen dieses Muster End-to-End.
Fazit
Gemini Omni Flash ist nicht mehr „API demnächst“. Seit dem 30. Juni 2026 können Sie gegen gemini-omni-flash-preview mit 0,10 $/s bauen — mit 10-Sekunden-Deckel und klaren Preview-Limits bei Audio-Referenzen und kurzen Video-Refs. Legen Sie konversationelle Edit-Flows hinter eine Provider-Schnittstelle, behalten Sie Veo für Workloads mit GA-Stabilität und beobachten Sie Googles Docs zu längeren Dauern und Audio-Referenz-Support.