Gemini Omni em agosto de 2026: beta privada da API, prévia do Omni Pro e novidades
Três meses após o I/O: a API Gemini Omni Flash abre beta privada no Google AI Studio e Vertex AI, Omni Pro antecipa clipes de 30 segundos, Google Flow ganha controles de timeline e preços do 2º semestre de 2026 são esclarecidos.
Três meses após o Google I/O
O Gemini Omni foi lançado no Google I/O em 19 de maio de 2026. Três meses depois, o cenário mudou de forma significativa: a API para desenvolvedores deixou de ser uma promessa vaga, o Gemini Omni Pro tem uma prévia concreta e o Google Flow recebeu os controles criativos que usuários avançados pediam desde o primeiro dia.
Este post é o check de status de agosto de 2026 — acesso à API, teaser do tier Pro, melhorias no Flow e no app Gemini, e o modelo de preços atualizado para a segunda metade do ano.
Status da API para desenvolvedores: beta privada ativa
A maior notícia de engenharia do verão: o Google abriu uma beta privada da API Gemini Omni Flash pelo Google AI Studio e Vertex AI. Ainda não é um rollout GA público — o acesso é limitado a parceiros enterprise e desenvolvedores aprovados na lista de espera.
O que os parceiros beta recebem
- Endpoints:
generateVideo,editVideoegenerateWithAvatar— espelhando o que usuários já têm no app Gemini e no Flow. - Limites de taxa: tiers beta começam em 10 operações concorrentes e 500 gerações por dia por projeto, com limites maiores negociáveis para parceiros de produção.
- SynthID + C2PA: cada resposta da API inclui metadados de marca d’água obrigatórios, alinhados à política de IA responsável do Google.
Sinais de preço (não definitivos)
O Google ainda não publicou preços oficiais da API, mas a documentação para parceiros beta cita tarifas estimadas de US$ 0,12–0,28 por segundo de vídeo gerado, conforme resolução e modo avatar. Isso posiciona o Omni Flash de forma competitiva frente ao Runway Gen-4 e abaixo dos tiers premium do Veo 3.1 em muitas cargas de trabalho.
Analistas que modelaram premissas do I/O em US$ 0,10–0,30/seg agora têm números reais — embora o Google avise que podem mudar antes do GA.
Lista de espera e cronograma
Desenvolvedores individuais podem se inscrever na lista de espera da Gemini API. Equipes enterprise devem passar pelo gerente de conta Google Cloud para Vertex AI. O Google mira GA público no outono de 2026, com limites mais amplos e cobrança self-service.
API Omni vs Veo 3.1 hoje
| Fator | API Veo 3.1 | API Omni Flash (beta) |
|---|---|---|
| Disponibilidade | Disponibilidade geral | Apenas beta privada |
| Edição multi-turno | Regenerar do zero | Edição conversacional nativa |
| Suporte a avatar | Indisponível | Integrado |
| Duração máxima do clipe | Até 8 segundos | Até 10 segundos (Flash) |
| Preços | Publicados (US$ 0,15–0,40/seg) | Estimados (US$ 0,12–0,28/seg) |
Conclusão para desenvolvedores: se você precisa de acesso API de produção hoje, Veo 3.1 continua sendo o caminho suportado. Se puder esperar até o outono de 2026 — ou se qualificar para a beta — comece a arquitetar atrás de uma interface de provider. Nosso guia de API para desenvolvedores detalha o padrão de migração.
Gemini Omni Pro: primeira olhada
O Google usou agosto para antecipar o Gemini Omni Pro — o tier mais capaz anunciado no I/O sem data. O acesso antecipado à prévia está sendo liberado para assinantes AI Ultra e parceiros enterprise beta selecionados.
O que o Pro adiciona em relação ao Flash
| Capacidade | Omni Flash | Omni Pro (prévia) |
|---|---|---|
| Duração máxima | 10 segundos | Até 30 segundos |
| Resolução | 720p | 1080p, 4K em testes |
| Áudio | Áudio nativo sincronizado | Síntese de áudio nativa com sincronização de vozes multi-papel |
| Consistência de personagem | Boa entre turnos | Bloqueio de identidade mais forte em sequências longas |
A demo principal do briefing de parceiros de agosto mostrou um clipe narrativo de 30 segundos com três papéis falantes distintos — cada um com timbre próprio, lábios sincronizados ao diálogo gerado — sem mixagem de áudio em pós-produção. É a diferenciação mais clara do Flash: o Pro é feito para conteúdo de extensão narrativa, não só ganchos curtos.
A prévia do Pro ainda não está disponível via API. O Google diz que endpoints Pro virão após o GA do Flash, provavelmente no fim de 2026.
Melhorias no Google Flow e no app Gemini
Agosto trouxe três upgrades para criadores do dia a dia:
Controles de timeline no Google Flow
O Flow agora expõe uma timeline visual de cenas — arraste para reordenar planos, corte segmentos individuais e visualize a sequência completa antes de exportar. Antes, a ordem das cenas era só conversacional; a timeline oferece precisão de NLE tradicional sem sair do workflow Omni.
Consistência de personagem no avatar
O recurso de avatar IA pessoal ganhou bloqueio de identidade entre cenas: sua likeness digital mantém aparência, figurino e timbre de voz em um projeto multi-plano inteiro, não só em uma geração. Isso fecha a maior lacuna entre avatares Omni e pipelines profissionais de deepfake.
Ajuste conversacional de voz
No app Gemini, você pode ajustar características de voz no meio da conversa — “deixe o narrador mais caloroso” ou “dê sotaque britânico ao personagem” — e o Omni aplica a mudança na próxima geração sem quebrar o contexto da cena.
Essas três funcionalidades estão ativas para assinantes AI Plus, Pro e Ultra na web e no mobile.
Preços atualizados e cotas baseadas em compute
O Google esclareceu a estrutura de assinatura do 2º semestre de 2026 com a atualização de agosto:
| Tier | Mensal | Acesso Omni | Cota compute |
|---|---|---|---|
| AI Plus | US$ 7,99 | Flash no app Gemini + Flow | Limites iniciais, ~refresh a cada 5 h |
| AI Pro | US$ 19,99 | Limites Flash maiores + créditos Flow | ~3× Plus, ~refresh a cada 5 h |
| AI Ultra | US$ 100 | Flash + prévia Pro, 5× limites Pro | Tier consumidor mais alto |
O modelo de cota baseado em compute — introduzido no I/O — agora está totalmente documentado: seus limites dependem da complexidade do prompt, duração do clipe e recursos usados (avatar, edição multi-turno etc.), atualizando aproximadamente a cada cinco horas até um teto semanal. Usuários intensivos do Flow no Plus podem atingir limites mais rápido que usuários leves do app Gemini no Pro — escolha o tier conforme sua superfície principal.
YouTube Shorts Remix e YouTube Create permanecem gratuitos para maiores de 18 anos, inalterados desde o lançamento.
Resumo e roadmap do outono de 2026
Agosto de 2026 marca a transição de “Omni como produto de consumo” para “Omni como plataforma”. Beta privada da API, prévia do Pro e controles de timeline no Flow são os três pilares.
O que esperar neste outono:
- GA público da API Omni Flash — acesso self-service via Gemini API e Vertex AI, preços publicados.
- Rollout mais amplo do Omni Pro — além da prévia Ultra, para assinantes Pro, clipes de 30 s e 1080p como padrão.
- Modalidades de saída de imagem e áudio — ainda comprometidas, ainda sem data, mas Google confirma testes internos em andamento.
- Integração com Workspace — rollout gradual do Omni no Google Docs, Slides e Vids para clientes enterprise.
Para a história completa do lançamento, veja nossas notas de lançamento de maio de 2026 e a atualização de junho. Arquitetura API: guia para desenvolvedores; comparação Veo: Gemini Omni vs Veo 3.1.