A API Gemini Omni Flash está no ar: preview público, US$ 0,10/s e o que devs precisam saber
Desde 30 de junho de 2026, gemini-omni-flash-preview está em preview público na Gemini API, Google AI Studio e Gemini Enterprise Agent Platform — com edição conversacional, limite de 10 segundos e US$ 0,10 por segundo.
A espera acabou
No Google I/O 2026, o Google disse que uma API para devs do Gemini Omni Flash chegaria «nas próximas semanas». Em 30 de junho de 2026, essa superfície de fato saiu: o ID do modelo gemini-omni-flash-preview está disponível no Google AI Studio, na Gemini API e na Gemini Enterprise Agent Platform.
Superfícies de consumo (app Gemini, Google Flow, YouTube Shorts / Create) já tinham Flash. Este post é sobre o momento developer — preços, limites e o que ainda não está pronto.
Post oficial de lançamento: Start building with Nano Banana 2 Lite and Gemini Omni Flash.
O que você pode chamar hoje
| Item | Valor |
|---|---|
| ID do modelo | gemini-omni-flash-preview |
| Status | Preview público |
| Preço de saída de vídeo | US$ 0,10 / segundo (igual ao Veo 3.1 Fast) |
| Duração máxima do clipe | 10 segundos (durações maiores em breve) |
| Resolução na API | 720p |
| Entradas | Texto, imagem, vídeo |
| Saídas | Vídeo (+ respostas em texto) |
| Edição | Conversacional, multi-turno |
| Proveniência | Marca d’água SynthID + C2PA Content Credentials |
Omni Flash é posicionado como o cavalo de batalha de vídeo de baixo custo na família Omni: referências multimodais, conhecimento de mundo ancorado no Gemini e edições estilo chat sem regenerar o clipe inteiro do zero.
Onde roda
Consumidores
- App Gemini (Google AI Plus / Pro / Ultra)
- Google Flow
- YouTube Shorts e YouTube Create (grátis para 18+)
Desenvolvedores
- Playground do Google AI Studio
- Gemini API
- Gemini Enterprise Agent Platform
Preços na prática
O Google precificou a saída de vídeo do Omni Flash em US$ 0,10 por segundo. Um clipe completo de 10 segundos custa cerca de US$ 1,00 de saída antes dos tokens de entrada. Os preços de preview não anunciam desconto Batch no momento, então ainda não há alavanca «mais barato se puder esperar» neste modelo.
Cotas de consumo ainda seguem os limites de compute das assinaturas Google AI. Não misture isso com cobrança de API ao modelar economia de agência ou unit economics de produto.
Limites para projetar em torno
O Google é explícito sobre as restrições do preview:
- Gerações de 10 segundos — teto rígido de produto por ora; clipes mais longos estão no roadmap.
- Sem referências de áudio na API — upload de áudio ainda não é suportado para este modelo na Gemini API (a saída ainda pode ter áudio nativo sincronizado).
- Referências de vídeo curtas são frágeis — o schema pode aceitar referências de vídeo de até 3 segundos, mas o Google informa que ainda não são processadas corretamente.
- Mudanças de cena e pans — consistência de personagem ainda pode escorregar entre cortes; planeje turnos extras de edição ou referências mais apertadas.
Trate isso como restrições de produto, não tickets temporários de suporte.
Omni Flash API vs Veo 3.1
| Fator | Omni Flash (preview) | Veo 3.1 |
|---|---|---|
| Arquitetura | Família Omni multimodal | Modelo de vídeo especializado |
| Edição | Edições conversacionais nativas | Re-prompt / regenerar |
| Sinal de preço | US$ 0,10 / s saída | Veo Fast alinha US$ 0,10 / s; tiers superiores custam mais |
| Duração do clipe | Até 10 s | Frequentemente ~8 s na documentação de produção |
| Maturidade | Preview público | Disponibilidade geral (GA) |
Se você precisa de um caminho de produção estável hoje, Veo 3.1 ainda importa. Se precisa de edição no chat e steering multimodal estilo Omni, o preview Flash é a nova superfície. O padrão limpo continua sendo uma interface VideoProvider com duas implementações — veja nosso guia de API para devs para o formato de migração (escrito antes do preview; este artigo é a atualização de status).
Combinando com modelos de imagem
O post de 30 de junho também lançou o Nano Banana 2 Lite para rascunhos de imagem rápidos e baratos. O loop previsto é simples: gere ou edite stills rapidamente, depois passe um frame escolhido ao Omni Flash como referência image-to-video. Apps demo no AI Studio mostram esse padrão ponta a ponta.
Conclusão
Gemini Omni Flash não é mais «API em breve». Desde 30 de junho de 2026 você pode construir contra gemini-omni-flash-preview a US$ 0,10/s, com teto de 10 segundos e limites claros de preview em referências de áudio e refs de vídeo curtas. Coloque fluxos de edição conversacional atrás de uma interface provider, mantenha Veo para cargas que precisam de estabilidade GA e acompanhe a documentação do Google para durações maiores e suporte a referências de áudio.