Google 將 Gemini Omni AI 直接整合到 YouTube Shorts 的創作工具中。Google 表示,Gemini Omni 是一個能「從任何輸入生成任何輸出」的 AI 模型家族,而影片生成與編輯是它的第一個主要應用場景。
在 YouTube 平台上,這個模型將支援多項新功能:
Google 的目標是讓影片創作更像「跟 AI 對話」,而不是使用複雜的剪輯軟體。
這次更新最引人注目的功能是 Conversational Editing(對話式編輯)。
創作者不需要逐一調整畫面元素,而是直接用文字描述想要的效果,例如:
Gemini Omni Flash 可以接受 文字、圖片、音訊或現有影片 作為輸入,再生成新的影片輸出,同時保持角色與畫面在不同鏡頭之間的一致性。
例如,創作者可以指示系統把影片中的金屬雕塑改成泡泡材質,或改變人物周圍的環境,而人物本身仍保持一致。
另一項能力是 將自己的臉或形象加入生成影片,讓使用者能在其他創作者的影片中以 AI 方式客串或重新演繹場景。
這套新流程其實由多個 Google AI 技術共同運作。
Gemini Omni 家族中第一個專門用於影片生成與編輯的模型。它可以整合多種媒體輸入,並輸出可編輯的影片內容。
Gemini Omni 被直接嵌入 YouTube Shorts 創作工具,讓創作者不必離開 YouTube 就能完成 AI 重混與編輯。
YouTube 的創作生態系(包括 YouTube Create)也能使用類似「Reimagine」的提示式編輯方式,對影片片段重新設計風格或生成新畫面。
Google 表示,Gemini Omni Flash 將同步推出於 Gemini App、Google Flow 和 YouTube Shorts,並在之後提供開發者與企業 API。
AI 影片重混可能模糊創作者的權利與來源,因此 YouTube 同時推出多項保護機制。
AI 生成 Shorts 預計會包含:
這些設計的目的是讓觀眾能清楚知道影片是否經過 AI 處理,以及內容來自哪位創作者。
此外,YouTube 也表示會提供 創作者選擇退出(opt‑out) 的機制,讓創作者可以拒絕自己的影片被 AI 系統用於重混或生成。
這項更新的時間點也相當關鍵。
2026 年,OpenAI 宣布停止 Sora 影片生成應用程式,該服務的 Web 與 App 體驗在 2026 年 4 月結束,而相關 API 預計在同年稍晚關閉。
與早期 AI 影片工具不同,YouTube 的策略不是推出一個獨立應用,而是把 AI 影片生成與編輯 直接嵌入全球最大的影片平台之一。
這意味著 AI 影片創作可能不再是專門工具,而會變成 Shorts 創作流程的一部分。
隨著 Gemini Omni 進入 Shorts,YouTube 正朝向一種新的創作模式:用提示語(prompt)來編輯影片。
未來創作者可能會更常:
如果這些工具如 Google 所描述般成熟,短影片創作的流程可能會從傳統剪輯,逐漸變成「描述你想要的影片」,然後讓 AI 幫你完成。