이번 업데이트의 핵심은 Google Maps의 Street View 데이터와 Project Genie의 결합이다. 이를 통해 AI가 현실 세계의 장소를 기반으로 환경을 생성할 수 있게 됐다.
사용 방식은 비교적 간단하다.
이렇게 생성된 공간은 단순히 보는 이미지가 아니라 사용자가 이동하며 탐험할 수 있는 가상 환경이다. 실제로는 비디오 게임 맵처럼 걸어 다니거나 주변을 살펴볼 수 있는 형태로 만들어진다.
또한 환경은 동적으로 생성되기 때문에 다음과 같은 창의적 변형도 가능하다.
즉 같은 실제 장소라도 완전히 다른 분위기의 세계로 재해석할 수 있다.
Project Genie는 일반적인 이미지 생성 도구와 달리 인터랙티브 세계 생성 도구에 가깝다.
현재 가능한 기능은 다음과 같다.
결과적으로 Project Genie는 이미지 생성기보다 ‘절차적으로 생성되는 게임 맵’에 더 가까운 시스템이다.
현재 Project Genie는 Google Labs에서 제공되는 실험적 연구 프로토타입이다.
접근 조건은 다음과 같다.
특히 Street View 기반 기능은 초기 단계에서 미국 내 위치 중심으로 제공되며, 시간이 지나면서 다른 지역으로 확대될 가능성이 있다.
Project Genie의 기반 기술은 Google DeepMind가 개발한 ‘Genie 3’ 월드 모델이다.
이 모델은 기존 생성형 AI와 달리 정적인 콘텐츠가 아니라 인터랙티브 환경 자체를 생성한다.
주요 기술 특징은 다음과 같다.
기술적으로는 언어 모델이 다음 단어를 예측하듯이, Genie는 이전 프레임과 사용자 행동을 기반으로 다음 장면을 예측해 생성한다.
Project Genie는 아직 초기 연구 단계이기 때문에 몇 가지 제한이 있다.
따라서 현재로서는 완전한 시뮬레이션 엔진이라기보다 실험적 AI 연구 프로젝트로 보는 것이 적절하다.
구글 딥마인드는 Project Genie를 환경을 이해하고 시뮬레이션할 수 있는 일반 AI 시스템으로 가는 과정의 일부로 설명한다.
가능한 활용 분야로는 다음이 언급된다.
프롬프트만으로 게임 환경을 생성할 수 있다면 게임 개발 속도를 크게 높일 가능성이 있다.
Street View 기반 환경은 도시, 역사적 장소, 자연 환경을 인터랙티브하게 탐험하는 학습 경험을 만들 수 있다.
로봇 개발에서는 실제 환경 대신 시뮬레이션에서 훈련하는 것이 중요하다. Genie처럼 무한한 환경을 생성할 수 있는 시스템은 AI 에이전트 학습용 가상 세계로 활용될 수 있다.
지금까지 대부분의 생성형 AI는 텍스트, 이미지, 영상 같은 콘텐츠를 만드는 데 집중해 왔다.
하지만 Genie 같은 월드 모델은 시간에 따라 반응하는 환경 자체를 생성한다.
이 변화는 다음과 같은 분야에 영향을 줄 수 있다.
Project Genie는 아직 초기 단계지만, 기술이 발전한다면 지도(Maps), 게임, 시뮬레이션, AI 훈련 환경의 경계가 하나의 플랫폼으로 합쳐질 가능성을 보여주는 사례로 평가된다.