Gemini Omni
Voltar para artigos
7 min de leitura

A API Gemini Omni Flash está no ar: preview público, US$ 0,10/s e o que devs precisam saber

Desde 30 de junho de 2026, gemini-omni-flash-preview está em preview público na Gemini API, Google AI Studio e Gemini Enterprise Agent Platform — com edição conversacional, limite de 10 segundos e US$ 0,10 por segundo.

Gemini OmniGemini Omni FlashAPIPricingGoogle AI Studio2026Português (Brasil)

A espera acabou

No Google I/O 2026, o Google disse que uma API para devs do Gemini Omni Flash chegaria «nas próximas semanas». Em 30 de junho de 2026, essa superfície de fato saiu: o ID do modelo gemini-omni-flash-preview está disponível no Google AI Studio, na Gemini API e na Gemini Enterprise Agent Platform.

Superfícies de consumo (app Gemini, Google Flow, YouTube Shorts / Create) já tinham Flash. Este post é sobre o momento developer — preços, limites e o que ainda não está pronto.

Post oficial de lançamento: Start building with Nano Banana 2 Lite and Gemini Omni Flash.

O que você pode chamar hoje

ItemValor
ID do modelogemini-omni-flash-preview
StatusPreview público
Preço de saída de vídeoUS$ 0,10 / segundo (igual ao Veo 3.1 Fast)
Duração máxima do clipe10 segundos (durações maiores em breve)
Resolução na API720p
EntradasTexto, imagem, vídeo
SaídasVídeo (+ respostas em texto)
EdiçãoConversacional, multi-turno
ProveniênciaMarca d’água SynthID + C2PA Content Credentials

Omni Flash é posicionado como o cavalo de batalha de vídeo de baixo custo na família Omni: referências multimodais, conhecimento de mundo ancorado no Gemini e edições estilo chat sem regenerar o clipe inteiro do zero.

Onde roda

Consumidores

  • App Gemini (Google AI Plus / Pro / Ultra)
  • Google Flow
  • YouTube Shorts e YouTube Create (grátis para 18+)

Desenvolvedores

  • Playground do Google AI Studio
  • Gemini API
  • Gemini Enterprise Agent Platform

Preços na prática

O Google precificou a saída de vídeo do Omni Flash em US$ 0,10 por segundo. Um clipe completo de 10 segundos custa cerca de US$ 1,00 de saída antes dos tokens de entrada. Os preços de preview não anunciam desconto Batch no momento, então ainda não há alavanca «mais barato se puder esperar» neste modelo.

Cotas de consumo ainda seguem os limites de compute das assinaturas Google AI. Não misture isso com cobrança de API ao modelar economia de agência ou unit economics de produto.

Limites para projetar em torno

O Google é explícito sobre as restrições do preview:

  1. Gerações de 10 segundos — teto rígido de produto por ora; clipes mais longos estão no roadmap.
  2. Sem referências de áudio na API — upload de áudio ainda não é suportado para este modelo na Gemini API (a saída ainda pode ter áudio nativo sincronizado).
  3. Referências de vídeo curtas são frágeis — o schema pode aceitar referências de vídeo de até 3 segundos, mas o Google informa que ainda não são processadas corretamente.
  4. Mudanças de cena e pans — consistência de personagem ainda pode escorregar entre cortes; planeje turnos extras de edição ou referências mais apertadas.

Trate isso como restrições de produto, não tickets temporários de suporte.

Omni Flash API vs Veo 3.1

FatorOmni Flash (preview)Veo 3.1
ArquiteturaFamília Omni multimodalModelo de vídeo especializado
EdiçãoEdições conversacionais nativasRe-prompt / regenerar
Sinal de preçoUS$ 0,10 / s saídaVeo Fast alinha US$ 0,10 / s; tiers superiores custam mais
Duração do clipeAté 10 sFrequentemente ~8 s na documentação de produção
MaturidadePreview públicoDisponibilidade geral (GA)

Se você precisa de um caminho de produção estável hoje, Veo 3.1 ainda importa. Se precisa de edição no chat e steering multimodal estilo Omni, o preview Flash é a nova superfície. O padrão limpo continua sendo uma interface VideoProvider com duas implementações — veja nosso guia de API para devs para o formato de migração (escrito antes do preview; este artigo é a atualização de status).

Combinando com modelos de imagem

O post de 30 de junho também lançou o Nano Banana 2 Lite para rascunhos de imagem rápidos e baratos. O loop previsto é simples: gere ou edite stills rapidamente, depois passe um frame escolhido ao Omni Flash como referência image-to-video. Apps demo no AI Studio mostram esse padrão ponta a ponta.

Conclusão

Gemini Omni Flash não é mais «API em breve». Desde 30 de junho de 2026 você pode construir contra gemini-omni-flash-preview a US$ 0,10/s, com teto de 10 segundos e limites claros de preview em referências de áudio e refs de vídeo curtas. Coloque fluxos de edição conversacional atrás de uma interface provider, mantenha Veo para cargas que precisam de estabilidade GA e acompanhe a documentação do Google para durações maiores e suporte a referências de áudio.

Relacionados