O Gemini Omni Flash, da Google DeepMind, foi anunciado em 19 de maio de 2026 no Google I/O e já está disponível para consumidores e desenvolvedores. Ele cria clipes de 3 a 10 segundos em 720p a partir de texto, imagens, áudio ou vídeos – e permite editar tudo por meio de conversas em linguagem natural.
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What are the key details about Google's Gemini Omni Flash model — including its release date, cap. Article summary: Here is a fact-checked breakdown of every key detail about **Gemini Omni Flash**.. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
A Google DeepMind apresentou a família de modelos Omni no Google I/O 2026, em 19 de maio de 2026, com o lema "crie qualquer coisa a partir de qualquer entrada, começando com vídeo". O primeiro integrante, o Gemini Omni Flash, começou a ser liberado para os consumidores no mesmo dia, chegando ao aplicativo Gemini, ao Google Flow e ao YouTube Shorts BW. O acesso para desenvolvedores veio em 30 de junho de 2026, como uma prévia pública, com o ID de modelo gemini-omni-flash-preview via Gemini API e Google AI Studio AAB. A ficha técnica oficial do modelo foi publicada pela Google DeepMind em 5 de julho de 2026 D.
Diferente de modelos que convertem entradas em sequência (um pipeline), o Gemini Omni Flash processa texto, imagens, áudio e vídeo como uma única entrada unificada e produz vídeo como saída — uma capacidade chamada "any-to-any" (de qualquer coisa para qualquer coisa) AAB. O modelo gera clipes de 3 a 10 segundos em 720p a 24 quadros por segundo nos formatos 16:9, 9:16 ou 1:1, com áudio nativo sincronizado criado na mesma etapa HG.
Você pode enviar ao modelo até sete imagens de referência, um clipe de vídeo e um briefing de texto em um único comando, e ele os combina em um resultado coerente BG. Por exemplo, um usuário pode fornecer fotos de um produto, um vídeo de fundo e uma descrição, e o Omni Flash gera um pequeno anúncio promocional.
A grande novidade é a edição de vídeo por conversa, possibilitada pela Interactions API AA. Em vez de exportar clipes para um programa de edição separado, os usuários podem refinar os resultados iterativamente usando linguagem natural — trocar personagens, trocar produtos, transferir estilos, adicionar objetos e mudar a iluminação — enquanto o modelo preserva as partes do vídeo que o usuário deseja manter AA. Cada rodada da conversa gera um novo vídeo, e o modelo entende o contexto das rodadas anteriores A.
O preço da API é de US$ 0,10 por segundo de vídeo gerado, o que equivale a US$ 1 por clipe de 10 segundos AH. Esse valor é similar ao do Veo 3.1 Fast, posicionando o Omni Flash como uma alternativa de menor custo e iteração mais rápida para fluxos de trabalho de vídeo Y. O preço também é de US$ 1,50 por milhão de tokens de entrada e US$ 17,50 por milhão de tokens de saída de vídeo H.
Para os consumidores, o Gemini Omni Flash é gratuito no YouTube Shorts para usuários com 18 anos ou mais AWN. Ele também está incluso nos planos de assinatura Google AI Plus, Pro e Ultra AG.
O limite de 10 segundos é uma decisão consciente de produto no lançamento, com durações maiores planejadas para o futuro HY. A Google caracterizou isso como uma estratégia de lançamento responsável, equilibrando capacidade com segurança T. Alguns comentaristas observam que o limite pode ser uma restrição do lado da implantação, e não uma limitação da arquitetura do modelo N.
Todo clipe gerado ou editado com o Omni Flash inclui uma marca d'água digital invisível do SynthID YNN. Os usuários podem verificar se um conteúdo foi criado por IA através do aplicativo Gemini, do Gemini no Chrome e da Pesquisa Google, perguntando: "Este vídeo foi criado com a IA do Google?" NB. Em superfícies compatíveis do Google, o conteúdo também carrega C2PA Content Credentials (credenciais de conteúdo) NC. Não há opção na API para desativar essa marcação DG.
Em 1º de julho de 2026, a Adobe adicionou o Gemini Omni Flash como um modelo parceiro dentro do Adobe Firefly, permitindo a edição de vídeos em inglês simples usando a interface e o sistema de créditos do Firefly D. O custo é de 30 créditos por segundo de vídeo D. Essa integração segue uma parceria mais ampla anunciada no Google I/O para trazer o conector da Adobe ao Gemini B. Os usuários podem acessá-lo no menu suspenso de Modelos no módulo Texto para Vídeo A.
Lançado junto com o Omni Flash, o Nano Banana 2 Lite (ID do modelo: gemini-3.1-flash-lite-image) é o modelo de imagem mais rápido e barato da família Nano Banana do Google AA. Ele gera imagens em menos de 4 segundos por menos de US$ 0,04 por 1.000 imagens BHB. A disponibilidade geral foi anunciada em 30 de junho de 2026 no Google Cloud, e ele está disponível no Google AI Studio, na Gemini API e na Plataforma de Agentes Empresariais Gemini HCB.
A Google apresentou o Omni Product Studio no Google I/O 2026, um aplicativo de demonstração que transforma imagens estáticas de produtos em vídeos cinematográficos de e-commerce usando o Gemini Omni Flash GC.
A edição de vídeos enviados pelo usuário está bloqueada para usuários no Espaço Econômico Europeu (EEE), Suíça e Reino Unido A. Relatos da comunidade também mencionam bloqueios na Índia e em alguns estados dos EUA A. O modelo também edita de forma confiável apenas seus próprios clipes gerados — e não envios arbitrários de terceiros — como uma medida de segurança contra o uso indevido de deepfakes A. As capacidades de edição de fala e áudio foram deliberadamente retidas no lançamento devido a preocupações com deepfakes TGL.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
O Gemini Omni Flash, da Google DeepMind, foi anunciado em 19 de maio de 2026 no Google I/O e já está disponível para consumidores e desenvolvedores.
O Gemini Omni Flash, da Google DeepMind, foi anunciado em 19 de maio de 2026 no Google I/O e já está disponível para consumidores e desenvolvedores. Ele cria clipes de 3 a 10 segundos em 720p a partir de texto, imagens, áudio ou vídeos – e permite editar tudo por meio de conversas em linguagem natural.
O preço da API é de US$ 0,10 por segundo de vídeo (US$ 1 por clipe de 10 segundos), com uso gratuito no YouTube Shorts para maiores de 18 anos.