L'API Gemini Omni Flash è live: anteprima pubblica, $0,10/sec e cosa devono sapere gli sviluppatori
Dal 30 giugno 2026 gemini-omni-flash-preview è in anteprima pubblica su Gemini API, Google AI Studio e Gemini Enterprise Agent Platform — con editing conversazionale, limite di 10 secondi e prezzo di $0,10 al secondo.
L’attesa è finita
Al Google I/O 2026 Google aveva promesso un’API per sviluppatori di Gemini Omni Flash «nelle prossime settimane». Il 30 giugno 2026 quella superficie è davvero arrivata: il model ID gemini-omni-flash-preview è disponibile in Google AI Studio, nella Gemini API e nella Gemini Enterprise Agent Platform.
Le superfici consumer (app Gemini, Google Flow, YouTube Shorts / Create) avevano già Flash. Questo post riguarda il momento developer — prezzi, limiti e cosa non è ancora pronto.
Articolo ufficiale di lancio: Start building with Nano Banana 2 Lite and Gemini Omni Flash.
Cosa puoi chiamare oggi
| Voce | Valore |
|---|---|
| Model ID | gemini-omni-flash-preview |
| Stato | Anteprima pubblica |
| Prezzo output video | $0,10 / secondo (come Veo 3.1 Fast) |
| Durata massima clip | 10 secondi (durate più lunghe in arrivo) |
| Risoluzione API | 720p |
| Input | Testo, immagine, video |
| Output | Video (+ risposte testuali) |
| Editing | Conversazionale, multi-turno |
| Provenance | Watermark SynthID + C2PA Content Credentials |
Omni Flash è posizionato come il cavallo di battaglia video a basso costo nella famiglia Omni: riferimenti multimodali, conoscenza del mondo ancorata a Gemini e modifiche in stile chat senza rigenerare l’intera clip da zero.
Dove gira
Consumer
- App Gemini (Google AI Plus / Pro / Ultra)
- Google Flow
- YouTube Shorts e YouTube Create (gratuito per 18+)
Sviluppatori
- Playground Google AI Studio
- Gemini API
- Gemini Enterprise Agent Platform
Prezzi nella pratica
Google ha fissato l’output video Omni Flash a $0,10 al secondo. Una clip completa da 10 secondi costa circa $1,00 di output prima dei token di input. I prezzi in anteprima non pubblicizzano attualmente uno sconto Batch, quindi non c’è ancora una leva «più economico se puoi aspettare» su questo modello.
Le quote consumer seguono ancora i limiti di compute degli abbonamenti Google AI. Non mescolarle con la fatturazione API quando modelli l’economia di un’agenzia o di un prodotto.
Limiti su cui progettare
Google è esplicito sulle restrizioni dell’anteprima:
- Generazioni da 10 secondi — tetto di prodotto per ora; clip più lunghe sono in roadmap.
- Nessun riferimento audio via API — l’upload audio non è supportato per questo modello sulla Gemini API (l’output può comunque avere audio nativo sincronizzato).
- Riferimenti video brevi sono fragili — lo schema può accettare riferimenti video fino a 3 secondi, ma Google segnala che al momento non vengono elaborati correttamente.
- Cambio scena e pan — la coerenza del personaggio può ancora slittare tra i tagli; prevedi turni di editing extra o riferimenti più stretti.
Trattali come vincoli di prodotto, non come ticket temporanei di supporto.
Omni Flash API vs Veo 3.1
| Fattore | Omni Flash (anteprima) | Veo 3.1 |
|---|---|---|
| Architettura | Famiglia Omni multimodale | Modello video specializzato |
| Editing | Modifiche conversazionali native | Re-prompt / rigenerazione |
| Segnale prezzo | $0,10 / sec output | Veo Fast allinea $0,10 / sec; tier superiori costano di più |
| Durata clip | Fino a 10 s | Spesso ~8 s nella documentazione di produzione |
| Maturità | Anteprima pubblica | Generalmente disponibile |
Se oggi ti serve un percorso di produzione stabile, Veo 3.1 conta ancora. Se ti serve editing in chat e steering multimodale in stile Omni, l’anteprima Flash è la nuova superficie. Il pattern pulito resta un’interfaccia VideoProvider con due implementazioni — vedi la nostra guida API per sviluppatori per la forma di migrazione (scritta prima dell’anteprima; questo articolo è l’aggiornamento di stato).
Abbinamento con modelli immagine
Il post del 30 giugno ha anche lanciato Nano Banana 2 Lite per bozzetti immagine veloci ed economici. Il loop previsto è semplice: genera o modifica still rapidamente, poi passa un frame scelto a Omni Flash come riferimento image-to-video. Le demo su AI Studio mostrano quel pattern end to end.
In sintesi
Gemini Omni Flash non è più «API a breve». Dal 30 giugno 2026 puoi sviluppare contro gemini-omni-flash-preview a $0,10/sec, con un tetto di 10 secondi e limiti chiari in anteprima su riferimenti audio e video brevi. Metti i flussi di editing conversazionale dietro un’interfaccia provider, tieni Veo per i carichi che richiedono stabilità GA e segui la documentazione Google per durate più lunghe e supporto ai riferimenti audio.