Google Gemini Omni Flash 是 Google DeepMind 旗下 Omni 系列的首款模型,於 2026 年 5 月 19 日的 Google I/O 大會上正式發表。 模型已開放給消費者使用,可在 Gemini 應用程式、Google Flow 及 YouTube Shorts 上體驗(Shorts 用戶免費)。
研究答案

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What are the key details about Google's Gemini Omni Flash model — including its release date, cap. Article summary: Here is a fact-checked breakdown of every key detail about **Gemini Omni Flash**.. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
Google DeepMind 於 2026 年 5 月 19 日的 Google I/O 大會上正式發表了全新的 Omni 模型系列,其核心概念是「透過任何輸入,創造任何輸出,並從影片開始」。該系列的首款模型 Gemini Omni Flash 已於當日同步在 Gemini 應用程式、Google Flow 以及 YouTube Shorts 上推出 BW。開發者則可自 2026 年 6 月 30 日起,透過 Gemini API 與 Google AI Studio 以模型 ID gemini-omni-flash-preview 進行公開預覽 AAB。Google DeepMind 隨後於 2026 年 7 月 5 日發布了官方的模型卡 D。
與傳統依序轉換輸入的管線模型不同,Gemini Omni Flash 能將文字、圖像、音訊和影片視為一個統一的輸入來處理,並直接輸出影片——這項能力被稱為「任意輸入」 AAB。該模型能生成 3 至 10 秒、720p 解析度、24 fps(每秒幀數) 的影片,支援 16:9、9:16 或 1:1 的畫面比例,並在單次處理中同步生成原生音訊 HG。
用戶在單一提示中最多可輸入七張參考圖像、一個影片片段及一段文字描述,模型會將其融合為一個邏輯一致的輸出 BG。舉例來說,用戶可以提供產品照片、背景影片和一段說明文字,Omni Flash 就能自動生成一支簡短的行銷宣傳片。
Omni Flash 最引人注目的功能是對話式影片編輯,此功能由 Interactions API 驅動 AA。用戶無需將片段匯出至獨立的剪輯軟體,只需透過自然語言反覆描述修改需求——例如更換角色、替換商品、轉換風格、添加物件或調整光影——模型便會根據指示進行修改,同時保留用戶希望維持的影片部分 AA。每一次的對話互動都會生成一段新影片,且模型能理解前後對話的脈絡 A。
API 定價為每秒生成的影片收取 $0.10 美元,相當於 每支 10 秒短片 $1 美元 AH。此價格與 Veo 3.1 Fast 相同,讓 Omni Flash 成為影片製作流程中更具成本效益、可更快迭代的選擇 Y。其輸入 Token 價格為每百萬個 $1.50 美元,影片輸出 Token 價格為每百萬個 $17.50 美元 H。
對一般消費者而言,18 歲及以上的用戶在 YouTube Shorts 上使用 Gemini Omni Flash 完全免費 AWN。此功能也包含在 Google AI Plus、Pro 和 Ultra 等訂閱方案中 AG。
發佈初期將每段影片長度限制在 10 秒,是 Google 刻意的產品決策,未來版本規劃支援更長的影片 HY。Google 將此視為負責任的推出策略的一部分,旨在平衡功能與安全性 T。部分評論認為,這項限制可能源自於部署階段的考量,而非模型本身的架構限制 N。
所有透過 Omni Flash 生成或編輯的影片都嵌入了不可見的 SynthID 數位浮水印 YNN。用戶可透過 Gemini 應用程式、Chrome 瀏覽器中的 Gemini 功能以及 Google 搜尋,直接提問「這部影片是用 Google AI 製作的嗎?」來驗證內容是否為 AI 生成 NB。在支援的 Google 平台中,相關內容也會帶有 C2PA 內容來源憑證 NC。API 端沒有提供關閉此浮水印功能的開關 DG。
自 2026 年 7 月 1 日起,Adobe 在其 Firefly 平台中將 Gemini Omni Flash 加入為合作夥伴模型,用戶可在 Firefly 熟悉的介面中使用日常語言進行影片編輯,並以 Firefly 的點數系統計費 D。其定價為每秒影片 30 點數 D。這項整合源於 Google I/O 上所宣布的更大範圍合作關係,旨在將 Adobe 的連接通引入 Gemini B。用戶可從文字轉影片模組的下拉式選單中選取此模型 A。
與 Omni Flash 同步推出的還有 Nano Banana 2 Lite(模型 ID: gemini-3.1-flash-lite-image),這是 Google 旗下 Nano Banana 家族中速度最快、成本最低的圖像模型 AA。它能在 4 秒內生成圖像,且成本低於每千張 $0.04 美元 BHB。該模型於 2026 年 6 月 30 日 在 Google Cloud 上宣布全面上市,並已開放於 Google AI Studio、Gemini API 及 Gemini Enterprise Agent Platform 中使用 HCB。
Google 在 2026 年的 I/O 大會上展示了 Omni Product Studio 示範應用。這套應用能利用 Gemini Omni Flash,將靜態的商品圖片直接轉換為電影風格的電子商務影片 GC。
在歐洲經濟區(EEA)、瑞士和英國的用戶,目前無法對上傳的影片進行編輯 A。社群報告也指出,印度及美國部分州份同樣受到限制 A。此外,作為防止深偽技術濫用的安全措施,該模型僅能可靠地編輯它自己生成的影片片段,而無法編輯任意第三方上傳的內容 A。考量到深偽風險,模型在推出初期刻意未開放語音和音訊編輯功能 TGL。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
Google Gemini Omni Flash 是 Google DeepMind 旗下 Omni 系列的首款模型,於 2026 年 5 月 19 日的 Google I/O 大會上正式發表。
Google Gemini Omni Flash 是 Google DeepMind 旗下 Omni 系列的首款模型,於 2026 年 5 月 19 日的 Google I/O 大會上正式發表。 模型已開放給消費者使用,可在 Gemini 應用程式、Google Flow 及 YouTube Shorts 上體驗(Shorts 用戶免費)。
開發者自 2026 年 6 月 30 日起可透過 Gemini API 與 Google AI Studio 取得公開預覽版。