Gemini Omni en août 2026 : bêta privée de l'API, aperçu d'Omni Pro et nouvelles fonctionnalités
Trois mois après I/O : l'API Gemini Omni Flash ouvre une bêta privée dans Google AI Studio et Vertex AI, Omni Pro prévisualise des clips de 30 secondes, Google Flow ajoute des contrôles de timeline et la tarification du second semestre 2026 est clarifiée.
Trois mois après Google I/O
Gemini Omni a été lancé lors du Google I/O le 19 mai 2026. Trois mois plus tard, le tableau a nettement évolué : l’API développeur n’est plus une promesse vague, Gemini Omni Pro dispose d’un aperçu concret, et Google Flow a reçu les contrôles créatifs que les utilisateurs avancés réclamaient depuis le premier jour.
Cet article fait le point d’août 2026 — accès API, aperçu du niveau Pro, améliorations Flow et app Gemini, et modèle tarifaire mis à jour pour la seconde moitié de l’année.
Statut de l’API développeur : bêta privée ouverte
La plus grande nouvelle technique de l’été : Google a ouvert une bêta privée de l’API Gemini Omni Flash via Google AI Studio et Vertex AI. Ce n’est pas encore un déploiement GA public — l’accès est limité aux partenaires entreprise et développeurs approuvés inscrits sur la liste d’attente.
Ce que reçoivent les partenaires bêta
- Endpoints :
generateVideo,editVideoetgenerateWithAvatar— reflétant ce que les utilisateurs ont déjà dans l’app Gemini et Flow. - Limites de débit : les niveaux bêta démarrent à 10 opérations concurrentes et 500 générations par jour par projet, avec des plafonds plus élevés négociables pour les partenaires production.
- SynthID + C2PA : chaque réponse API inclut des métadonnées de filigrane obligatoires, conformes à la politique IA responsable de Google.
Signaux tarifaires (non définitifs)
Google n’a pas encore publié de tarifs API officiels, mais la documentation partenaire bêta cite des tarifs estimés de 0,12 à 0,28 USD par seconde de vidéo générée, selon la résolution et l’activation du mode avatar. Omni Flash se positionne ainsi de manière compétitive face à Runway Gen-4 et en dessous des niveaux premium Veo 3.1 pour de nombreuses charges.
Les analystes qui modélisaient des hypothèses I/O à 0,10–0,30 USD/s disposent désormais de chiffres réels — Google prévient toutefois que ces montants peuvent changer avant le GA.
Liste d’attente et calendrier
Les développeurs individuels peuvent postuler via la liste d’attente Gemini API. Les équipes entreprise doivent passer par leur gestionnaire de compte Google Cloud pour Vertex AI. Google vise un GA public à l’automne 2026, avec des limites élargies et une facturation en libre-service.
API Omni vs Veo 3.1 aujourd’hui
| Facteur | API Veo 3.1 | API Omni Flash (bêta) |
|---|---|---|
| Disponibilité | Disponibilité générale | Bêta privée uniquement |
| Édition multi-tours | Régénération depuis zéro | Édition conversationnelle native |
| Support avatar | Non disponible | Intégré |
| Durée max du clip | Jusqu’à 8 secondes | Jusqu’à 10 secondes (Flash) |
| Tarification | Publiée (0,15–0,40 USD/s) | Estimée (0,12–0,28 USD/s) |
En bref pour les développeurs : si vous avez besoin d’un accès API production aujourd’hui, Veo 3.1 reste la voie supportée. Si vous pouvez attendre l’automne 2026 — ou êtes éligible à la bêta — commencez à architecturer derrière une interface provider. Notre guide développeur API détaille le schéma de migration.
Gemini Omni Pro : premier aperçu
Google a utilisé août pour teaser Gemini Omni Pro — le niveau supérieur annoncé à I/O sans calendrier. L’accès anticipé à l’aperçu est déployé pour les abonnés AI Ultra et certains partenaires entreprise bêta.
Ce que Pro ajoute par rapport à Flash
| Capacité | Omni Flash | Omni Pro (aperçu) |
|---|---|---|
| Durée max | 10 secondes | Jusqu’à 30 secondes |
| Résolution | 720p | 1080p, 4K en test |
| Audio | Audio natif synchronisé | Synthèse audio native avec synchronisation vocale multi-rôles |
| Cohérence personnage | Bonne entre les tours | Verrouillage d’identité renforcé sur séquences longues |
La démo phare du briefing partenaires d’août montrait un clip narratif de 30 secondes avec trois rôles parlants distincts — chacun avec son timbre, lèvres synchronisées au dialogue généré — sans mixage audio en post-production. C’est la différenciation la plus nette avec Flash : Pro vise le contenu de longueur narrative, pas seulement les hooks courts.
L’aperçu Pro n’est pas encore disponible via API. Google indique que les endpoints Pro suivront le GA Flash, probablement fin 2026.
Améliorations Google Flow et app Gemini
Août a apporté trois mises à niveau pour les créateurs au quotidien :
Contrôles de timeline dans Google Flow
Flow expose désormais une timeline visuelle de scènes — glisser pour réordonner les plans, rogner des segments individuels, prévisualiser la séquence complète avant export. Auparavant, l’ordre des scènes était uniquement conversationnel ; la timeline offre la précision d’un NLE traditionnel sans quitter le workflow Omni.
Cohérence personnage avatar
La fonction avatar IA personnel a gagné un verrouillage d’identité inter-scènes : votre likeness numérique conserve apparence, garde-robe et timbre vocal sur tout un projet multi-plans, pas seulement dans une génération. Cela comble l’écart principal entre avatars Omni et pipelines deepfake professionnels.
Réglage vocal conversationnel
Dans l’app Gemini, vous pouvez ajuster les caractéristiques vocales en cours de conversation — « rends le narrateur plus chaleureux » ou « donne un accent britannique au personnage » — et Omni applique le changement à la génération suivante sans casser le contexte de scène.
Ces trois fonctionnalités sont actives pour les abonnés AI Plus, Pro et Ultra sur web et mobile.
Tarification et quotas compute mis à jour
Google a clarifié la structure d’abonnement du second semestre 2026 avec la mise à jour d’août :
| Niveau | Mensuel | Accès Omni | Quota compute |
|---|---|---|---|
| AI Plus | 7,99 USD | Flash dans app Gemini + Flow | Limites entrée, ~rafraîchissement 5 h |
| AI Pro | 19,99 USD | Limites Flash supérieures + crédits Flow | ~3× Plus, ~rafraîchissement 5 h |
| AI Ultra | 100 USD | Flash + aperçu Pro, 5× limites Pro | Niveau consommateur le plus élevé |
Le modèle de quota basé sur le compute — introduit à I/O — est désormais entièrement documenté : vos limites dépendent de la complexité du prompt, de la durée du clip et des fonctionnalités utilisées (avatar, édition multi-tours, etc.), avec rafraîchissement environ toutes les cinq heures jusqu’à un plafond hebdomadaire. Les utilisateurs Flow intensifs sur Plus peuvent atteindre les limites plus vite que des utilisateurs légers de l’app Gemini sur Pro — choisissez le niveau selon votre surface principale.
YouTube Shorts Remix et YouTube Create restent gratuits pour les 18 ans et plus, inchangés depuis le lancement.
Synthèse et feuille de route automne 2026
Août 2026 marque le passage d’« Omni produit grand public » à « Omni plateforme ». La bêta API privée, l’aperçu Pro et les contrôles timeline Flow en sont les trois piliers.
À attendre cet automne :
- GA public API Omni Flash — accès libre-service via Gemini API et Vertex AI, tarifs publiés.
- Déploiement élargi Omni Pro — au-delà de l’aperçu Ultra, vers les abonnés Pro, clips 30 s et 1080p par défaut.
- Modalités sortie image et audio — toujours engagées, toujours sans date, mais Google confirme des tests internes en cours.
- Intégration Workspace — déploiement progressif d’Omni dans Google Docs, Slides et Vids pour les clients entreprise.
Pour l’histoire complète du lancement, voir nos notes de version mai 2026 et la mise à jour juin. Architecture API : guide développeur ; comparaison Veo : Gemini Omni vs Veo 3.1.