Output multimodale nativo
Un solo prompt produce testo coerente, keyframe e video con personaggi, stile e illuminazione costanti tra i formati.
Gemini Omni 1.1 Flash è stato lanciato il 27 agosto 2026 — l'aggiornamento production-ready di Google con estensioni di scena fino a 40 secondi, controllo del primo e ultimo frame, modalità bozza 360p, upscaling 4K e riferimenti video. Sostituisce Veo nell'app Gemini ed è disponibile su Google Flow, YouTube Shorts, Google Vids, Google AI Studio e Gemini Enterprise Agent Platform.
Ogni clip qui sotto è incorporata direttamente dalla pagina prodotto ufficiale di Gemini Omni: text-to-video, image-to-video, style transfer, editing in chat, video-to-video e AI avatar — l’intera superficie funzionale.
Tutti i video demo sono © Google, usati qui per aggregazione informativa; trasmessi direttamente da storage.googleapis.com/gweb-gemini-cdn.
Il main hero reel di Gemini Omni: crea, remixa e modifica video parlando.
Un solo prompt testuale produce un clip multi-shot con ambiente e linguaggio di camera coerenti.
Carica immagini di riferimento e Omni guida il movimento, riempiendo automaticamente la timeline.
Cambia sfondo, abito o trasferisci lo stile — il soggetto conserva i suoi dettagli.
Reinterpreta un materiale già esistente in un nuovo stile — luce, lente o anche materiale riscritti dal prompt.
Riassegna personaggi, aggiusta l’illuminazione, stabilizza le inquadrature — solo chattando, senza rigenerare.
Imposta una volta l’AI avatar e poi apparire in ogni video futuro senza ricaricare foto.
A differenza di modelli video specializzati come Veo, Sora 2, Seedance 2.0 o Kling, Gemini Omni mantiene ragionamento linguistico, generazione di immagini, generazione video e sintesi audio nella stessa architettura.
Un solo prompt produce testo coerente, keyframe e video con personaggi, stile e illuminazione costanti tra i formati.
Niente più catene di modelli specializzati. Testo, immagine, video e audio condividono gli stessi pesi e lo stesso contesto lungo.
Audio ambientale, colonna sonora e dialoghi vengono allineati all’immagine nello stesso forward pass — i passi cadono sul beat e le labbra combaciano con il parlato al primo export.
Sostituisci un oggetto, cambia l’illuminazione, regola un movimento di camera in linguaggio naturale — senza rigenerare tutto, sulla scia di Nano Banana.
Carica una clip esistente e reindirizzala con un prompt. Immagini, video e audio di riferimento possono essere combinati in un’unica istruzione.
Template integrati per spot di prodotto, Reels, music video e short cinematografici abbassano la barriera d’ingresso mantenendo coerente il linguaggio della camera.
I valori seguono il lancio production di Google del 27 agosto 2026 per gemini-omni-1.1-flash. Disponibile via Google AI Studio e Gemini Enterprise Agent Platform.
| Dimensione | Segnale noto |
|---|---|
| Famiglia del modello | Google Gemini Omni — 1.1 Flash è la release production-ready |
| ID modello | gemini-omni-1.1-flash |
| Durata clip | Fino a 10 secondi per generazione · fino a 40 secondi con estensioni di scena (incrementi da 10 secondi) |
| Risoluzione | 360p bozza · 720p standard · 1080p · upscale 4K |
| Proporzioni | 16:9, 9:16, 1:1 |
| Audio | Audio nativo sincronizzato in output · riferimenti audio API non ancora supportati |
| Input | Testo / immagine / video (riferimento audio API non ancora supportato) |
| Accesso | App Gemini, Google Flow, YouTube Shorts/Create, Google Vids · developer via Gemini API, Google AI Studio e Gemini Enterprise Agent Platform |
| Prezzi API | $0,10 al secondo di output video (come Veo 3.1 Fast) |
Lo stack generativo di Google era diviso tra Veo per il video, Nano Banana / Imagen per l’immagine e Gemini per il testo. Omni riunisce tutto in un’unica architettura.
Prima
Veo 3.1
Video + audio nativo
Nano Banana / Imagen
Generazione e editing immagini
Gemini 2.5 / 3.x
Ragionamento · contesto lungo
Ora · Omni
Gemini Omni
Testo · immagine · video · audio, un modello, un prompt
Un modello unificato con contesto lungo e audio sincronizzato consente ai team di scrivere un brief coerente e ottenere un montaggio finito.
Hero shot, reveal packaging e lifestyle cut consegnati con audio ambientale già pronto.
Clip verticali 9:16 con dialogo on-mic e movimento sincronizzato al beat, pensate per lo scroll social.
Carica una traccia e Omni taglia i visual sul beat mantenendo il personaggio costante.
Concatena più omni-clip da 10 secondi in sequenze multi-shot con illuminazione e bed audio continui.
Clip atmosferiche 16:9 loopabili per SaaS, fashion e DTC — brandizzate e silent-friendly.
Trasforma uno script in una sequenza con voiceover lip-sync e audio ambientale coerente.
Aggregato da Artificial Analysis, Looksy AI, Oimi AI e dai keynote ufficiali — orientativo, non punteggi di benchmark.
| Modello | Produttore | Architettura | Audio nativo | Durata clip |
|---|---|---|---|---|
| Gemini Omni
Omni
| Omni unificato (video + immagine + audio) | Sincronizzato in un solo pass | 10s · fino a 40s | |
| Veo 3.1 | Modello video specializzato | Sì | ~8s | |
| Seedance 2.0 | ByteDance | Video multimodale specializzato | Sì | fino a 15s / shot |
| Sora 2 | OpenAI | Modello video specializzato | Sì | ~20s |
| Kling V3.0 | Kuaishou | Modello video specializzato | Limitato | ~10s |
Gemini Omni Flash è gratis nel piano gratuito di Google Flow, su YouTube Shorts e nell’app YouTube Create. L’app Gemini autonoma richiede Google AI Plus, Pro o Ultra. Apri qui sotto gli ingressi ufficiali.
Lo studio di filmmaking AI di Google. Il piano gratuito include Gemini Omni Flash con limiti di utilizzo; passa a Plus / Pro / Ultra per limiti più alti e strumenti pro.
ApriGenera clip Gemini Omni Flash dentro Shorts senza costi. Il modo ufficiale più economico per provare Omni gratis.
ApriEditor mobile con Gemini Omni Flash integrato. Nessun abbonamento AI richiesto.
ApriUsa Omni nell’app ufficiale Gemini. Richiede un piano Google AI Plus, Pro o Ultra.
ApriPercorso gratis più rapido: accedi a YouTube Shorts o all'app YouTube Create, scegli un template e usa gli stessi prompt multi-inquadratura dell'app Gemini.
Quote gratuite e prezzi cambiano per regione e account. Verifica sempre sugli ingressi ufficiali qui sopra.
In ordine di data di pubblicazione. Aggiornato fino al lancio production di Omni 1.1 Flash del 27 agosto 2026.
L’utente X @Thomas16937378 individua "Start with an idea or try a template. Powered by Omni." nella scheda video di Gemini.
TestingCatalog e Chetaslua mostrano la card "Meet our new video model", l’ID modello completo e il limite di 10 secondi per clip.
Un clip con un "professore che risolve trigonometria alla lavagna" evidenzia coerenza testuale e fedeltà fisica, accendendo il confronto con Veo 3.1.
Google presenta Gemini Omni sul palco principale di I/O 2026, pubblica una pagina prodotto ufficiale con video demo e inizia a sostituire Veo 3.1 nell’app Gemini.
Il lancio include avatar AI personale, editing video-to-video ed editing conversazionale multi-turn — limitati per geografia e tier di abbonamento.
Il model ID gemini-omni-flash-preview arriva su Google AI Studio, Gemini API e Gemini Enterprise Agent Platform a $0,10 al secondo di output video — stessa tariffa di Veo 3.1 Fast. Sono supportati editing conversazionale e riferimenti multimodali (testo, immagine, video); i riferimenti audio API non sono ancora disponibili.
Il model ID gemini-omni-1.1-flash diventa production-ready via Google AI Studio e Gemini Enterprise Agent Platform. Nuove capacità: estensioni di scena fino a 40 secondi, specifica del primo e ultimo frame, modalità bozza 360p (60% più veloce, 1/3 del costo), upscaling 4K e riferimenti video. Integrato da Adobe Firefly, Figma Weave, Runway e altri.
Google ha annunciato un rollout più ampio di Gemini Omni Pro oltre l'anteprima Ultra, insieme a modalità di output immagine e audio oltre l'attuale lancio video-first — la promessa completa 'qualsiasi input → qualsiasi output'.
Gemini Omni è la famiglia multimodale unificata di Google. Il modello di produzione è Gemini Omni 1.1 Flash (gemini-omni-1.1-flash), che genera video con audio nativo sincronizzato da input testo, immagine e video in un'unica architettura. Supporta estensioni di scena fino a 40 secondi, controllo primo/ultimo frame, bozze 360p e upscaling 4K.
In parte. Gemini Omni Flash è gratis nel piano gratuito di Google Flow, su YouTube Shorts e nell’app YouTube Create. Per usare Omni nell’app Gemini autonoma serve un piano a pagamento Google AI Plus, Pro o Ultra.
Google AI Plus parte da circa 7,99 USD/mese, AI Pro è il piano più diffuso tra i creator, AI Ultra costa circa 100 USD/mese. Due generazioni Omni Flash consumano circa l’86% della quota giornaliera di AI Pro: pianifica con cura i retry. L’API per sviluppatori arriverà con un prezzo separato.
È già arrivato. Google ha annunciato Gemini Omni sul palco principale di Google I/O 2026 il 19 maggio 2026, pubblicando contemporaneamente pagina prodotto ufficiale e video demo.
Gemini Omni è il successore di Veo nell’app Gemini — Google afferma esplicitamente che "Omni sostituirà Veo nell’app Gemini". Lo stack video è ora inglobato nella stessa architettura di Gemini testo e immagine.
Sì. Audio ambientale, colonna sonora e dialoghi sono prodotti nello stesso pass del video — è il motivo per cui si chiama "omni".
Clip singole fino a 10 secondi, con estensioni di scena fino a 40 secondi totali (incrementi da 10 secondi). Supporta audio nativo, fino a 5 riferimenti foto, riferimenti video fino a 3 secondi ed editing multi-turn. Bozza in 360p o upscale fino a 4K.
Gemini Omni richiede un piano Google AI Plus, Pro o Ultra e l’età 18+. Alcune funzioni (avatar, editing video-to-video) potrebbero essere limitate in certi paesi.
Una versione digitale opzionale di te stesso che permette a Gemini di generare video con il tuo aspetto e la tua voce senza ricaricare le foto ogni volta — e solo tu puoi usare il tuo avatar.
Tutto ciò che si trova in questa pagina è aggregato dalle fonti pubbliche qui sotto. Consigliata la lettura incrociata.
Annuncio ufficiale con lancio di Omni Flash, capacità, superfici e piano di rollout.
Recap completo del I/O 2026 su Gemini Omni, il nuovo piano AI Ultra da 100$ e i lanci correlati.
Pagina di lancio ufficiale con video demo, tour delle funzioni, piani supportati e dettagli di rollout.
Panoramica di analisti indipendenti su come Omni unifica gli stack Veo + Imagen in un unico modello e su cosa è disponibile ora vs. dopo.
Dettagli dei leak, stringhe UI e prime analisi delle demo.
ID modello completo, prompt in-app e reazioni della community.
Riepilogo ordinato di specifiche, casi d’uso e confronti.
Multimodalità a livello di famiglia, contesto lungo e direzione agentica.