L'API Gemini Omni Flash est en ligne : aperçu public, 0,10 $/s et ce que les développeurs doivent savoir
Depuis le 30 juin 2026, gemini-omni-flash-preview est en aperçu public sur Gemini API, Google AI Studio et Gemini Enterprise Agent Platform — édition conversationnelle, plafond de 10 secondes et 0,10 $ par seconde de vidéo.
L’attente est terminée
À Google I/O 2026, Google a annoncé qu’une API développeurs pour Gemini Omni Flash arriverait « dans les semaines à venir ». Le 30 juin 2026, cette promesse s’est matérialisée : l’ID modèle gemini-omni-flash-preview est disponible dans Google AI Studio, la Gemini API et Gemini Enterprise Agent Platform.
Les surfaces grand public (app Gemini, Google Flow, YouTube Shorts / Create) avaient déjà Flash. Cet article porte sur le moment développeur — tarifs, limites et ce qui n’est pas encore prêt.
Article officiel de lancement : Start building with Nano Banana 2 Lite and Gemini Omni Flash.
Ce que vous pouvez appeler aujourd’hui
| Élément | Valeur |
|---|---|
| ID modèle | gemini-omni-flash-preview |
| Statut | Aperçu public |
| Prix sortie vidéo | 0,10 $ / seconde (identique à Veo 3.1 Fast) |
| Durée max du clip | 10 secondes (durées plus longues à venir) |
| Résolution API | 720p |
| Entrées | Texte, image, vidéo |
| Sorties | Vidéo (+ réponses texte) |
| Édition | Conversationnelle, multi-tours |
| Provenance | Filigrane SynthID + C2PA Content Credentials |
Omni Flash se positionne comme le cheval de bataille vidéo économique de la famille Omni : références multimodales, connaissance du monde ancrée dans Gemini et retouches style chat sans régénérer tout le clip.
Où ça tourne
Consommateurs
- App Gemini (Google AI Plus / Pro / Ultra)
- Google Flow
- YouTube Shorts et YouTube Create (gratuit pour les 18 ans et plus)
Développeurs
- Playground Google AI Studio
- Gemini API
- Gemini Enterprise Agent Platform
Tarification en pratique
Google a fixé la sortie vidéo Omni Flash à 0,10 $ par seconde. Un clip complet de 10 secondes coûte environ 1,00 $ de sortie avant les tokens d’entrée. Le tarif d’aperçu n’annonce pas actuellement de remise Batch — pas encore de levier « moins cher si vous pouvez attendre » sur ce modèle.
Les quotas consommateurs suivent les plafonds de calcul de l’abonnement Google AI. Ne les mélangez pas à la facturation API lorsque vous modélisez l’économie unitaire d’une agence ou d’un produit.
Limites à intégrer dès la conception
Google est explicite sur les contraintes d’aperçu :
- Générations de 10 secondes — plafond produit dur pour l’instant ; des clips plus longs sont sur la feuille de route.
- Pas de références audio via API — l’upload audio comme référence n’est pas pris en charge pour ce modèle sur Gemini API (la sortie peut toutefois porter un audio natif synchronisé).
- Les courtes références vidéo sont fragiles — le schéma peut accepter des références vidéo jusqu’à 3 secondes, mais Google indique qu’elles ne sont pas encore traitées correctement.
- Changements de plan et panoramiques — la cohérence des personnages peut déraper entre les coupes ; prévoyez des tours d’édition supplémentaires ou des références plus serrées.
Traitez-les comme des contraintes produit, pas comme des tickets de support temporaires.
API Omni Flash vs Veo 3.1
| Facteur | Omni Flash (aperçu) | Veo 3.1 |
|---|---|---|
| Architecture | Famille Omni multimodale | Modèle vidéo spécialisé |
| Édition | Retouches conversationnelles natives | Re-prompt / régénération |
| Signal tarifaire | 0,10 $ / s de sortie | Veo Fast aligné à 0,10 $ / s ; paliers supérieurs plus chers |
| Durée du clip | Jusqu’à 10 s | Souvent ~8 s en docs de production |
| Maturité | Aperçu public | Disponibilité générale (GA) |
Si vous avez besoin aujourd’hui d’un chemin de production stable, Veo 3.1 compte toujours. Si vous voulez l’édition en chat et le pilotage multimodal style Omni, l’aperçu Flash est la nouvelle surface. Le schéma propre reste une interface VideoProvider avec deux implémentations — voir notre guide développeur API pour la forme de migration (rédigé avant l’aperçu ; cet article est la mise à jour de statut).
Association avec les modèles image
Le billet du 30 juin a aussi lancé Nano Banana 2 Lite pour des brouillons d’image rapides et bon marché. La boucle prévue est simple : générer ou retoucher des images fixes rapidement, puis passer une image choisie à Omni Flash comme référence image-to-video. Les apps démo sur AI Studio montrent ce schéma de bout en bout.
En bref
Gemini Omni Flash n’est plus « API bientôt ». Depuis le 30 juin 2026, vous pouvez construire sur gemini-omni-flash-preview à 0,10 $/s, avec un plafond de 10 secondes et des limites d’aperçu claires sur les références audio et les courtes références vidéo. Placez les flux d’édition conversationnelle derrière une interface provider, gardez Veo pour les charges qui exigent la stabilité GA, et surveillez la doc Google pour des durées plus longues et le support des références audio.