Gemini Omni
Zurück zu allen Artikeln
6 Min. Lesezeit

Gemini Omni im August 2026: API-Private Beta, Omni Pro-Teaser und Feature-Updates

Drei Monate nach I/O: Gemini Omni Flash API startet Private Beta in Google AI Studio und Vertex AI, Omni Pro-Preview mit 30-Sekunden-Clips, Google Flow erhält Timeline-Steuerung, H2-2026-Preise und Kontingente geklärt.

Gemini OmniGemini Omni FlashGemini Omni ProAPIGoogle Flow2026Deutsch

Drei Monate nach Google I/O

Gemini Omni wurde am 19. Mai 2026 auf dem Google I/O vorgestellt. Drei Monate später hat sich das Bild deutlich gewandelt: Die Developer-API ist keine vage Zusage mehr, Gemini Omni Pro hat eine konkrete Vorschau, und Google Flow hat die kreativen Steuerungen erhalten, die Power-User seit Tag eins verlangten.

Dieser Beitrag ist der Status-Check für August 2026 — API-Zugang, Pro-Tier-Teaser, Flow- und Gemini-App-Upgrades sowie das aktualisierte Preismodell für die zweite Jahreshälfte.

Developer-API-Status: Private Beta ist live

Die größte Engineering-Nachricht des Sommers: Google hat eine Private Beta für die Gemini Omni Flash API über Google AI Studio und Vertex AI eröffnet. Noch kein öffentliches GA — der Zugang ist auf Enterprise-Partner und genehmigte Entwickler mit Wartelisteneintrag beschränkt.

Was Beta-Partner erhalten

  • Endpoints: generateVideo, editVideo und generateWithAvatar — analog zu dem, was Nutzer bereits in der Gemini-App und Flow haben.
  • Rate Limits: Beta-Stufen starten bei 10 gleichzeitigen Operationen und 500 Generierungen pro Tag pro Projekt, höhere Limits für Produktionspartner verhandelbar.
  • SynthID + C2PA: Jede API-Antwort enthält verpflichtende Wasserzeichen-Metadaten gemäß Googles Responsible-AI-Richtlinie.

Preissignale (nicht final)

Google hat noch keine offiziellen API-Preise veröffentlicht, aber Beta-Partner-Dokumentation nennt geschätzte Sätze von 0,12–0,28 USD pro Sekunde generiertes Video, abhängig von Auflösung und Avatar-Modus. Omni Flash liegt damit bei vielen Workloads wettbewerbsfähig gegen Runway Gen-4 und unter Premium-Veo-3.1-Stufen.

Analysten, die I/O-Annahmen bei 0,10–0,30 USD/Sek. modelliert hatten, haben jetzt echte Zahlen — Google warnt jedoch vor Änderungen vor GA.

Warteliste und Zeitplan

Einzelentwickler können sich über die Gemini-API-Warteliste bewerben. Enterprise-Teams sollten über ihren Google-Cloud-Account-Manager Vertex-AI-Zugang anfragen. Google zielt auf öffentliches GA im Herbst 2026 mit breiteren Limits und Self-Service-Abrechnung.

Omni-API vs. Veo 3.1 heute

FaktorVeo-3.1-APIOmni-Flash-API (Beta)
VerfügbarkeitAllgemein verfügbar (GA)Nur Private Beta
Multi-Turn-BearbeitungNeu generieren von Grund aufNative konversationelle Bearbeitung
Avatar-UnterstützungNicht verfügbarIntegriert
Max. Clip-LängeBis 8 SekundenBis 10 Sekunden (Flash)
PreiseVeröffentlicht (0,15–0,40 USD/Sek.)Geschätzt (0,12–0,28 USD/Sek.)

Fazit für Entwickler: Wer heute produktiven API-Zugang braucht, bleibt bei Veo 3.1 als unterstütztem Pfad. Wer bis Herbst 2026 warten kann — oder Beta-berechtigt ist — sollte jetzt hinter einer Provider-Schnittstelle architektieren. Details in unserem API-Entwicklerleitfaden.

Gemini Omni Pro: erster Blick

Google nutzte August, um Gemini Omni Pro anzuteasern — die leistungsstärkere Stufe, die auf dem I/O ohne Zeitplan angekündigt wurde. Früher Preview-Zugang rollt für AI-Ultra-Abonnenten und ausgewählte Enterprise-Beta-Partner aus.

Was Pro gegenüber Flash bietet

FähigkeitOmni FlashOmni Pro (Preview)
Max. Clip-Länge10 SekundenBis 30 Sekunden
Auflösung720p1080p, 4K in Tests
AudioSynchronisiertes natives AudioNative Audiosynthese mit Multi-Rollen-Sprachsync
CharakterkonsistenzGut über TurnsStärkerer Identity-Lock über längere Sequenzen

Die Headline-Demo beim August-Partner-Briefing zeigte einen 30-Sekunden-Narrativ-Clip mit drei unterschiedlichen Sprecherrollen — jeweils eigener Stimmklang, Lippensync zu generiertem Dialog — ohne Postproduktions-Audiomix. Das ist die klarste Abgrenzung zu Flash: Pro ist für Story-Länge-Inhalte gebaut, nicht nur Short-Hooks.

Pro-Preview ist noch nicht per API verfügbar. Google sagt, Pro-Endpoints folgen dem Flash-GA, vermutlich Ende 2026.

Google Flow und Gemini-App-Verbesserungen

August brachte drei Upgrades für Alltags-Creator:

Timeline-Steuerung in Google Flow

Flow bietet jetzt eine visuelle Szenen-Timeline — Shots per Drag-and-drop sortieren, einzelne Segmente trimmen, komplette Sequenz vor Export vorab ansehen. Zuvor war die Szenenreihenfolge nur chatgesteuert; die Timeline liefert NLE-Präzision ohne den Omni-Workflow zu verlassen.

Avatar-Charakterkonsistenz

Das persönliche KI-Avatar-Feature erhielt Identity-Lock über Szenen hinweg: Dein digitales Abbild behält Erscheinung, Kleidung und Stimmklang über ein ganzes Multi-Shot-Projekt, nicht nur innerhalb einer Generierung. Das schließt die größte Lücke zwischen Omni-Avataren und professionellen Deepfake-Pipelines.

Konversationelles Voice-Tuning

In der Gemini-App kannst du Stimmmerkmale mitten im Gespräch anpassen — „Mach den Erzähler wärmer“ oder „Gib der Figur einen britischen Akzent“ — und Omni wendet die Änderung auf die nächste Generierung an, ohne Szenenkontext zu brechen.

Alle drei Features sind live für AI Plus-, Pro- und Ultra-Abonnenten auf Web und Mobil.

Aktualisierte Preise und Compute-basierte Kontingente

Google klärte die Abo-Struktur für H2 2026 mit dem August-Update:

StufeMonatlichOmni-ZugangCompute-Kontingent
AI Plus7,99 USDFlash in Gemini-App + FlowEinstiegslimits, ~5-Stunden-Refresh
AI Pro19,99 USDHöhere Flash-Limits + Flow-Credits~3× Plus, ~5-Stunden-Refresh
AI Ultra100 USDFlash + Pro-Preview, 5× Pro-LimitsHöchste Consumer-Stufe

Das Compute-basierte Kontingentmodell — auf dem I/O eingeführt — ist jetzt vollständig dokumentiert: Limits hängen von Prompt-Komplexität, Clip-Länge und genutzten Features (Avatar, Multi-Turn-Edit usw.) ab, mit Refresh etwa alle fünf Stunden bis zum Wochenlimit. Flow-Heavy-User auf Plus können Limits schneller erreichen als leichte Gemini-App-Nutzer auf Pro — wähle die Stufe nach deiner Hauptoberfläche.

YouTube Shorts Remix und YouTube Create bleiben kostenlos für Nutzer ab 18, unverändert seit Launch.

Zusammenfassung und Herbst-2026-Roadmap

August 2026 markiert den Übergang von „Omni als Consumer-Produkt“ zu „Omni als Plattform“. Private API-Beta, Pro-Preview und Flow-Timeline sind die drei Säulen.

Erwartungen für den Herbst:

  1. Öffentliches Omni-Flash-API-GA — Self-Service über Gemini API und Vertex AI, veröffentlichte Preise.
  2. Breiteres Omni-Pro-Rollout — über Ultra-Preview hinaus zu Pro-Abonnenten, Standard 30-Sekunden-Clips und 1080p.
  3. Bild- und Audio-Output-Modalitäten — weiter committed, weiter undatiert, interne Tests laufen laut Google.
  4. Workspace-Integration — schrittweise Omni in Google Docs, Slides und Vids für Enterprise-Kunden.

Zur Launch-Geschichte siehe Mai-2026-Release-Notes und Juni-Status-Update. API-Architektur: Entwicklerleitfaden; Veo-Vergleich: Gemini Omni vs. Veo 3.1.