Gemini Omni Flash API is live: publieke preview, $0,10/sec en wat builders moeten weten
Vanaf 30 juni 2026 staat gemini-omni-flash-preview in publieke preview op de Gemini API, Google AI Studio en Gemini Enterprise Agent Platform — met conversationele editing, een limiet van 10 seconden en $0,10 per seconde.
Het wachten is voorbij
Op Google I/O 2026 zei Google dat een developer-API voor Gemini Omni Flash «in de komende weken» zou komen. Op 30 juni 2026 is die surface daadwerkelijk geland: model-ID gemini-omni-flash-preview is beschikbaar in Google AI Studio, de Gemini API en het Gemini Enterprise Agent Platform.
Consumentenplatforms (Gemini-app, Google Flow, YouTube Shorts / Create) hadden Flash al. Dit artikel gaat over het developer-moment — prijzen, limieten en wat nog niet klaar is.
Officiële lancering: Start building with Nano Banana 2 Lite and Gemini Omni Flash.
Wat je vandaag kunt aanroepen
| Item | Waarde |
|---|---|
| Model-ID | gemini-omni-flash-preview |
| Status | Publieke preview |
| Videoprijs output | $0,10 / seconde (zelfde als Veo 3.1 Fast) |
| Max. cliplengte | 10 seconden (langere duur komt eraan) |
| API-resolutie | 720p |
| Input | Tekst, beeld, video |
| Output | Video (+ tekstantwoorden) |
| Editing | Conversationeel, multi-turn |
| Herkomst | SynthID-watermerk + C2PA Content Credentials |
Omni Flash is gepositioneerd als het kostenefficiënte videoworkhorse in de Omni-familie: multimodale referenties, Gemini-grounded wereldkennis en chat-achtige edits zonder de hele clip opnieuw te genereren.
Waar het draait
Consumenten
- Gemini-app (Google AI Plus / Pro / Ultra)
- Google Flow
- YouTube Shorts en YouTube Create (gratis voor 18+)
Developers
- Google AI Studio playground
- Gemini API
- Gemini Enterprise Agent Platform
Prijzen in de praktijk
Google prijst Omni Flash-video-output op $0,10 per seconde. Een volledige clip van 10 seconden kost ongeveer $1,00 output vóór inputtokens. Previewprijzen adverteren geen Batch-korting, dus er is nog geen «goedkoper als je kunt wachten»-hefboom op dit model.
Consumentenquota volgen nog steeds de compute-limieten van Google AI-abonnementen. Meng die niet met API-facturering wanneer je agency- of product-unit economics modellert.
Limieten waar je rekening mee moet houden
Google is expliciet over previewbeperkingen:
- 10-seconden generaties — harde productlimiet voor nu; langere clips staan op de roadmap.
- Geen API-audioreferenties — audio-upload wordt voor dit model op de Gemini API nog niet ondersteund (output kan wel native gesynchroniseerde audio bevatten).
- Korte videoreferenties zijn broos — het schema accepteert mogelijk videoreferenties tot 3 seconden, maar Google merkt op dat die momenteel niet correct worden verwerkt.
- Scenewissels en pannen — karakterconsistentie kan nog wegglijden tussen cuts; plan extra editturns of strakkere referenties.
Behandel dit als productconstraints, niet als tijdelijke supporttickets.
Omni Flash API vs Veo 3.1
| Factor | Omni Flash (preview) | Veo 3.1 |
|---|---|---|
| Architectuur | Multimodale Omni-familie | Gespecialiseerd videomodel |
| Editing | Native conversationele edits | Re-prompt / regenereren |
| Prijssignaal | $0,10 / sec output | Veo Fast matcht $0,10 / sec; hogere tiers kosten meer |
| Cliplengte | Tot 10 s | Vaak ~8 s in productiedocs |
| Volwassenheid | Publieke preview | Algemeen beschikbaar |
Als je vandaag een stabiel productiepad nodig hebt, telt Veo 3.1 nog steeds. Als je in-chat editing en Omni-achtige multimodale sturing nodig hebt, is Flash preview de nieuwe surface. Het schone patroon blijft één VideoProvider-interface met twee implementaties — zie onze eerdere API-developergids voor de migratievorm (geschreven vóór de preview; dit artikel is de statusupdate).
Combineren met beeldmodellen
De post van 30 juni lanceerde ook Nano Banana 2 Lite voor snelle, goedkope beelddrafts. De bedoelde loop is simpel: genereer of bewerk stills snel, geef dan een gekozen frame door aan Omni Flash als image-to-video-referentie. Demo-apps op AI Studio tonen dat patroon end-to-end.
Conclusie
Gemini Omni Flash is niet langer «API binnenkort». Vanaf 30 juni 2026 kun je bouwen tegen gemini-omni-flash-preview voor $0,10/sec, met een 10-seconden-limiet en duidelijke previewbeperkingen op audioreferenties en korte videorefs. Zet conversationele-edit flows achter een providerinterface, houd Veo voor workloads die GA-stabiliteit nodig hebben, en volg Google’s docs voor langere duur en audioreferentie-ondersteuning.