Disponível para desenvolvedores como modelo geralmente disponível na API Gemini desde 27 de agosto de 2026, o Gemini Omni 1.1 Flash é melhor entendido como uma atualização de controle e fluxo de trabalho — não como um... A Google informa preço de US$ 17,50 por milhão de tokens de saída de vídeo.
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is Google’s Gemini Omni 1.1 Flash video model, and how do its new capabilities—including scene extension using up to 10 seconds of prio. Article summary: Gemini Omni 1.1 Flash is Google’s fast, multimodal video-generation and editing model. Its significance for professional teams is less “one-click finished film” than a more controllable production loop: draft cheaply, di. Topic tags: general, general web, documentation, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
O Gemini Omni 1.1 Flash é o modelo multimodal e rápido da Google para gerar e editar vídeos. A principal novidade não é a promessa de que cada quadro será melhor que o dos concorrentes, mas uma mudança no fluxo de produção: criar rascunhos baratos, preservar mais contexto ao prolongar uma cena, definir como uma transição começa e termina e só então renderizar uma versão em resolução mais alta para entrega. 4533
O modelo aceita entradas de texto, imagem e vídeo e produz vídeo como saída. A documentação da API da Google lista vídeos de 3 a 10 segundos, a 24 quadros por segundo, com opções de 360p, 720p, 1080p e 4K. Na documentação, os vídeos usados para edição e extensão podem ter até 10 segundos. 1
Isso torna o Omni 1.1 Flash especialmente relevante para editores, motion designers, agências e equipes de produto. Em vez de depender apenas de um prompt isolado, o modelo pode trabalhar a partir de materiais visuais aprovados e ser incorporado a um processo repetível.
Ao prolongar uma gravação, o Gemini Omni 1.1 Flash consegue analisar até 10 segundos do vídeo anterior. Materiais anteriores do Omni descreviam uma janela de contexto bem mais estreita. Agora, o modelo recebe mais informações sobre personagem, iluminação, movimento de câmera e ação antes de gerar a continuação. 511
As extensões são geradas em blocos de 10 segundos e podem chegar a um clipe acumulado de 40 segundos. Cada geração individual continua limitada a 3–10 segundos. Portanto, trata-se de uma continuação em etapas — não de um único prompt capaz de produzir uma cena longa sem limite. 124
Para uma equipe de produção, essa diferença é importante. O diretor pode aprovar uma tomada curta, continuar a partir dela e criar ramificações mantendo o trabalho organizado em saídas de duração administrável. O contexto mais amplo pode reduzir desvios de continuidade, mas não garante consistência perfeita de personagens, objetos, iluminação ou movimento.
O modelo pode gerar um vídeo entre duas imagens fornecidas: um quadro inicial e um quadro final. O changelog da API da Google descreve o recurso como uma interpolação dentro do fluxo de imagem para vídeo. 33
Na prática, isso oferece uma forma mais clara de definir o destino visual de uma tomada. Um editor pode fornecer a composição inicial de um produto e a posição exigida para a revelação final, deixando que o modelo crie o movimento entre os dois pontos. O mesmo processo pode ser usado para transições, loops e pontes de movimento de câmera, embora cada resultado ainda precise ser testado na tomada real.
A vantagem é o controle. Na geração baseada apenas em prompt, o modelo precisa deduzir tanto o começo quanto o fim da cena. Com os quadros de referência, a equipe fixa essas duas decisões criativas antes de pedir que a IA preencha o movimento.
Segundo a Google, prévias em 360p podem ser renderizadas até 60% mais rápido e custam um terço do valor da saída padrão em 720p. 5
Isso cria uma escala de custos útil para storyboard e aprovação:
A documentação de preços da Google lista 1.931 tokens de saída por segundo para vídeos em 360p e 5.792 tokens por segundo para vídeos em 720p. Com a tarifa publicada de US$ 17,50 por milhão de tokens de saída de vídeo, isso corresponde a aproximadamente US$ 0,034 por segundo em 360p e US$ 0,101 por segundo em 720p, antes das cobranças de entrada e de saída de texto. 4143
Por isso, a conta final não é simplesmente um preço fixo por clipe. Mídia de entrada, respostas de texto, resolução, duração e a plataforma usada podem alterar o valor total.
A API oferece opções de 1080p e 4K, além de 360p e 720p. Nos materiais de lançamento, a Google posiciona os modos de maior resolução, incluindo 4K, como uma etapa para finalizar trabalhos selecionados depois da experimentação de menor custo. 134
Isso é útil para separar a criação e a aprovação da renderização final. Também evita um erro comum: gastar o orçamento de geração em alta resolução com ideias que ainda não foram aprovadas no storyboard ou no movimento.
O Omni 1.1 Flash foi projetado para receber entradas multimodais. Assim, uma equipe pode combinar instruções escritas com referências visuais, como frames de estilo, imagens de produto, uma gravação-base ou um breve exemplo de movimento. 14
Um processo orientado por referências costuma ser mais fácil de revisar do que um processo baseado apenas em texto, porque o briefing criativo passa a ter elementos visuais concretos. Antes da geração, a equipe pode definir o que precisa permanecer fixo — por exemplo, o design de um produto, o tratamento de um logotipo, a aparência de um personagem ou a composição inicial — e o que pode ser criado pela IA.
O vídeo de referência não substitui permissões nem um sistema completo de continuidade. A equipe ainda precisa verificar se tem direito de usar o material enviado, se os resultados preservam corretamente elementos protegidos de uma marca e se a saída atende aos requisitos editoriais e legais do projeto.
A página de preços da API Gemini lista o Gemini Omni 1.1 Flash a US$ 1,50 por milhão de tokens de entrada, US$ 9 por milhão de tokens de saída de texto e US$ 17,50 por milhão de tokens de saída de vídeo. A Google documenta a cobrança de vídeo em 5.792 tokens por segundo para a saída em 720p; nessa taxa, o custo é de aproximadamente US$ 0,10 por segundo gerado, sem contar outras cobranças aplicáveis. 41
O changelog da API identifica gemini-omni-1.1-flash como o modelo geralmente disponível para desenvolvedores no nível pago da API Gemini. 3341
A disponibilidade, porém, não é igual em todos os produtos da Google. Os anúncios voltados ao consumidor colocam o Gemini Omni no aplicativo Gemini e no Google Flow para assinantes dos planos Google AI Plus, Pro e Ultra. Já as notas de versão do Gemini Enterprise Agent Platform listam o Gemini Omni 1.1 Flash como Public Preview, ou prévia pública. Antes de fechar um pipeline de produção, as equipes devem confirmar o ID atual do modelo, a região, a cota, o status de cobrança e a disponibilidade específica de cada produto. 202232
As evidências fornecidas não estabelecem um anúncio oficial suficientemente claro sobre uma integração direta com o Figma. Por isso, essa afirmação não deve ser tratada como confirmada. É mais seguro separar o acesso comprovado ao modelo pelas plataformas de desenvolvedor e criação da Google de relatos de terceiros sobre integrações ou uso por clientes.
Para compradores profissionais, a questão mais importante não é apenas se uma marca aparece em uma história de lançamento. O essencial é saber se o modelo está disponível dentro do processo real de revisão, gerenciamento de ativos, edição e aprovação da equipe, com APIs estáveis e cobrança previsível.
Gemini Omni 1.1 Flash e OpenAI Sora não devem ser comparados por meio de uma única manchete. O material disponível sustenta uma conclusão mais específica: a Google está disputando com mais força o mercado profissional de vídeo com IA ao enfatizar continuidade de cenas, controle dos pontos inicial e final, referências multimodais, rascunhos rápidos e iteração via API. 433
As fontes fornecidas não trazem evidências independentes e representativas suficientes para afirmar que o Omni 1.1 Flash produz, de forma consistente, imagens mais realistas, física melhor ou continuidade superior à do Sora. Também não há um benchmark unificado que torne os dois sistemas diretamente equivalentes.
Uma comparação séria deve usar os mesmos prompts, referências, durações de tomada, resoluções e critérios de aceitação. Vale medir:
Um fluxo sensato com o Omni 1.1 Flash seria:
O modelo pode reduzir o custo da experimentação e o trabalho manual necessário para criar tomadas de ligação. Ele não elimina as decisões editoriais que determinam se um vídeo é coerente, legalmente utilizável, tecnicamente compatível e pronto para publicação.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
Disponível para desenvolvedores como modelo geralmente disponível na API Gemini desde 27 de agosto de 2026, o Gemini Omni 1.1 Flash é melhor entendido como uma atualização de controle e fluxo de trabalho — não como um...
Disponível para desenvolvedores como modelo geralmente disponível na API Gemini desde 27 de agosto de 2026, o Gemini Omni 1.1 Flash é melhor entendido como uma atualização de controle e fluxo de trabalho — não como um... A Google informa preço de US$ 17,50 por milhão de tokens de saída de vídeo. No ritmo documentado de 5.792 tokens por segundo, isso equivale a cerca de US$ 0,10 por segundo em 720p; o custo final também depende das ent...
O modelo torna a produção de vídeo com IA mais iterativa e previsível, mas ainda exige edição convencional, revisão de direitos, tratamento de som e controle de qualidade.