이번 기능의 중심에는 Gemini Omni라는 새로운 멀티모달 AI 모델 계열이 있다. 구글은 이 모델을 “어떤 입력이든 받아 결과물을 만들어낼 수 있는 AI”라고 소개했으며, 첫 번째 주요 활용 사례가 바로 영상 생성과 편집이다.
특히 Gemini Omni Flash 모델은 다음과 같은 입력을 동시에 처리할 수 있다.
이 다양한 입력을 결합해 일관된 장면과 캐릭터를 유지하는 편집 가능한 영상을 생성한다.
예를 들어 크리에이터가 기존 쇼츠 영상을 업로드한 뒤 “금속 조형물을 거품으로 바꿔줘”라고 요청하면, AI가 장면 속 사람과 동작은 유지하면서 해당 객체만 자연스럽게 변형할 수 있다.
이번 업데이트에서 가장 눈길을 끄는 기능 중 하나는 자신의 얼굴이나 아바타를 영상에 삽입하는 기능이다.
사용자는 기존 쇼츠를 기반으로 다음과 같은 작업을 할 수 있다.
이 기능은 새로운 형태의 AI 카메오(cameo) 리믹스를 가능하게 하며, 다른 크리에이터의 영상 속 장면에 자신이 등장하는 콘텐츠도 만들 수 있다.
이 AI 편집 기능은 별도 앱이 아니라 유튜브 쇼츠 제작 도구 내부에 직접 통합된다.
핵심 구성 요소는 다음과 같다.
영상 생성과 편집을 위해 설계된 Gemini Omni 모델의 첫 버전으로, 여러 형태의 입력을 결합해 편집 가능한 영상을 생성한다.
쇼츠 제작 인터페이스 안에서 바로 AI 편집을 사용할 수 있어, 클립을 플랫폼 밖으로 내보낼 필요 없이 리믹스가 가능하다.
유튜브의 제작 도구들과 연결되어 장면을 새 스타일로 바꾸거나 재생성하는 프롬프트 기반 편집 기능을 제공한다.
구글은 Gemini Omni Flash가 Gemini 앱, Google Flow, 그리고 YouTube Shorts에서 먼저 제공되며 이후 개발자와 기업을 위한 API도 출시할 예정이라고 밝혔다.
AI 리믹스가 확산되면 콘텐츠 출처가 모호해질 수 있기 때문에 유튜브는 몇 가지 투명성 장치를 도입했다.
AI로 생성된 쇼츠에는 다음 정보가 표시될 예정이다.
또한 크리에이터는 **자신의 영상이 AI 리믹스에 사용되는 것을 거부(옵트아웃)**할 수 있는 옵션도 제공받게 된다.
이번 발표가 주목받는 이유 중 하나는 AI 영상 시장의 변화와도 관련이 있다.
OpenAI는 2026년에 영상 생성 서비스 Sora의 웹·앱 경험을 종료했으며, 관련 API도 2026년 9월 종료될 예정이라고 밝혔다.
이와 달리 유튜브의 접근 방식은 AI 영상 생성 기능을 거대한 콘텐츠 플랫폼 내부에 직접 통합하는 것이다. 수십억 사용자를 가진 플랫폼에서 AI 편집이 기본 기능이 되면, 영상 제작 방식 자체가 크게 바뀔 가능성이 있다.
Gemini Omni가 쇼츠 제작 도구에 들어오면서 영상 제작 과정은 점점 프롬프트 중심 워크플로로 바뀔 가능성이 있다.
앞으로 크리에이터는 다음과 같은 방식으로 콘텐츠를 만들 수 있다.
기술이 계획대로 작동한다면, 짧은 영상을 만드는 과정은 전통적인 편집보다 **“원하는 장면을 설명하는 과정”**에 더 가까워질 수 있다.