在 5 月 19 日的 Google I/O 2026 大會上,Google 發表了全新的 Gemini Omni 模型系列。官方形容這是「朝向一個能從任何輸入創造任何內容的模型的第一步——從影片開始」。與以往由多個獨立工具拼湊而成的系統不同,Omni 是從零開始打造的單一多模態生成模型 。
系列中的第一款模型 Gemini Omni Flash 已在 2026 年 5 月 20 日正式上線 。它可以接受文字、圖片、音訊和影片作為輸入,並輸出可供編輯的影片,還支援對話式編輯,每一句提示詞都會承接前一輪的對話脈絡 。
Gemini Omni Flash 主要透過三個管道開放使用 :
開發者用的 API 則預計在數週後釋出 。
根據早期報導,Omni Flash 能生成長達 10 秒的 1080p 影片片段,並帶有原生音訊 。由於模型內建對物理現象和真實世界物體行為的理解,它能盡可能維持視覺上的一致性——角色在不同鏡頭間外觀不變、光影保持協調,還可透過對話直接調整鏡位角度 。
所有產出的影片都會附上 SynthID 浮水印 。另外還有一個虛擬人偶功能,可以將自己的臉孔與聲音放進生成的影片中 。
當你在和朋友用訊息討論去哪裡吃飯時,Magic Cue 現在會建議你呼叫 Gemini 來找餐廳選項,並以浮動視窗的方式在聊天畫面中顯示結果,完全不必切換應用程式 。Gemini 還能代勞日常瑣事,像是幫你訂外送生鮮或預約乘車服務,同時將主控權留在你手上,這項功能是以測試版的形式在 Gemini 應用程式中逐步推出 。
更廣泛的六月 Android Drop 還包含了 Google Photos「衣櫥」功能,自 2026 年六月第二週起在美國、印度與巴西上線,以及預計六月下旬登陸 Android 版 Chrome 的 Gemini 整合功能 。
六月 Pixel Drop 已於 2026 年 6 月 2 至 3 日左右開始在支援的 Pixel 裝置上推送,各項功能會依據電信商和裝置型號的不同,在接下來幾週內分階段陸續到位 。螢幕反應預計今年夏天登陸 Pixel 手機 ,而 Gemini Omni Flash 目前已對所有 Google AI 訂閱戶及 YouTube Shorts 使用者開放 。