Gemini Omni
Zurück zu allen Artikeln
7 Min. Lesezeit

Gemini Omni Flash API ist live: Public Preview, 0,10 $/s und was Entwickler wissen sollten

Seit dem 30. Juni 2026 ist gemini-omni-flash-preview in Public Preview auf Gemini API, Google AI Studio und Gemini Enterprise Agent Platform — konversationelles Editing, 10-Sekunden-Deckel und 0,10 $ pro Sekunde Videoausgabe.

Gemini OmniGemini Omni FlashAPIPricingGoogle AI Studio2026Deutsch

Das Warten ist vorbei

Auf der Google I/O 2026 sagte Google, die Entwickler-API für Gemini Omni Flash komme „in den kommenden Wochen“. Am 30. Juni 2026 wurde das Wort gehalten: Die Modell-ID gemini-omni-flash-preview ist in Google AI Studio, der Gemini API und der Gemini Enterprise Agent Platform verfügbar.

Consumer-Oberflächen (Gemini-App, Google Flow, YouTube Shorts / Create) hatten Flash bereits. Dieser Beitrag dreht sich um den Entwickler-Moment — Preise, Limits und was noch nicht bereit ist.

Offizieller Launch-Beitrag: Start building with Nano Banana 2 Lite and Gemini Omni Flash.

Was Sie heute aufrufen können

PunktWert
Modell-IDgemini-omni-flash-preview
StatusPublic Preview
Preis Videoausgabe0,10 $ / Sekunde (wie Veo 3.1 Fast)
Max. Cliplänge10 Sekunden (längere Dauern folgen)
API-Auflösung720p
EingabenText, Bild, Video
AusgabenVideo (+ Textantworten)
EditingKonversationell, Multi-Turn
HerkunftSynthID-Wasserzeichen + C2PA Content Credentials

Omni Flash ist das kosteneffiziente Video-Workhorse in der Omni-Familie: multimodale Referenzen, Gemini-grounded Weltwissen und Chat-Edits ohne den ganzen Clip neu zu generieren.

Wo es läuft

Verbraucher

  • Gemini-App (Google AI Plus / Pro / Ultra)
  • Google Flow
  • YouTube Shorts und YouTube Create (kostenlos ab 18)

Entwickler

  • Google AI Studio Playground
  • Gemini API
  • Gemini Enterprise Agent Platform

Preise in der Praxis

Google bepreist Omni-Flash-Videoausgabe mit 0,10 $ pro Sekunde. Ein voller 10-Sekunden-Clip kostet etwa 1,00 $ Ausgabe vor Input-Tokens. Preview-Preise werben derzeit keinen Batch-Rabatt — es gibt auf diesem Modell noch keinen „billiger, wenn Sie warten können“-Hebel.

Consumer-Kontingente folgen weiter den Compute-Limits des Google-AI-Abos. Vermischen Sie die nicht mit API-Abrechnung, wenn Sie Agentur- oder Produkt-Stückkosten modellieren.

Limits, die Sie einplanen sollten

Google ist explizit zu Preview-Einschränkungen:

  1. 10-Sekunden-Generierungen — harte Produktgrenze vorerst; längere Clips stehen auf der Roadmap.
  2. Keine API-Audio-Referenzen — Audio-Upload als Referenz wird für dieses Modell in der Gemini API noch nicht unterstützt (Ausgabe kann dennoch natives synchrones Audio tragen).
  3. Kurze Video-Referenzen sind brüchig — das Schema akzeptiert ggf. Video-Referenzen bis 3 Sekunden, Google weist aber darauf hin, dass sie derzeit nicht korrekt verarbeitet werden.
  4. Szenenwechsel und Schwenks — Charakterkonsistenz kann über Schnitte hinweg rutschen; planen Sie extra Edit-Turns oder engere Referenzen ein.

Behandeln Sie das als Produktconstraints, nicht als temporäre Support-Tickets.

Omni Flash API vs Veo 3.1

FaktorOmni Flash (Preview)Veo 3.1
ArchitekturMultimodale Omni-FamilieSpezialisiertes Videomodell
EditingNative konversationelle EditsRe-Prompt / Regenerieren
Preissignal0,10 $ / s AusgabeVeo Fast ebenfalls 0,10 $ / s; höhere Tiers teurer
CliplängeBis 10 sIn Produktionsdocs oft ~8 s
ReifePublic PreviewAllgemein verfügbar (GA)

Wer heute einen stabilen Produktionspfad braucht, setzt weiter auf Veo 3.1. Wer In-Chat-Editing und Omni-artige multimodale Steuerung will, ist Flash Preview die neue Oberfläche. Das saubere Muster bleibt eine VideoProvider-Schnittstelle mit zwei Implementierungen — siehe unseren API-Entwicklerleitfaden für die Migrationsform (vor der Preview geschrieben; dieser Artikel ist das Status-Update).

Kombination mit Bildmodellen

Der 30.-Juni-Post brachte auch Nano Banana 2 Lite für schnelle, günstige Bildentwürfe. Die vorgesehene Schleife ist einfach: Stills schnell generieren oder bearbeiten, dann ein gewähltes Frame als Image-to-Video-Referenz an Omni Flash übergeben. Demo-Apps in AI Studio zeigen dieses Muster End-to-End.

Fazit

Gemini Omni Flash ist nicht mehr „API demnächst“. Seit dem 30. Juni 2026 können Sie gegen gemini-omni-flash-preview mit 0,10 $/s bauen — mit 10-Sekunden-Deckel und klaren Preview-Limits bei Audio-Referenzen und kurzen Video-Refs. Legen Sie konversationelle Edit-Flows hinter eine Provider-Schnittstelle, behalten Sie Veo für Workloads mit GA-Stabilität und beobachten Sie Googles Docs zu längeren Dauern und Audio-Referenz-Support.

Weiterlesen