這類技術屬於研究人員所說的 「世界模型(World Model)」——即 AI 不只是生成圖片或影片,而是能即時模擬整個環境並回應用戶行為。
最新版本把 Project Genie 與 Google Maps 的 Street View 資料庫連接起來,讓 AI 生成的環境可以以真實世界影像為基礎。
基本流程大概是:
完成後,用戶可以 像在遊戲中一樣四處移動和探索該地點的 AI 模擬版本。
因為環境是即時生成的,用戶亦可以改變設定,例如:
換句話說,同一條街可以被 AI 「重新想像」成完全不同的世界。
Project Genie 更像是一個 互動世界生成器,而不是單純的圖像或影片生成工具。
目前功能包括:
因此它更接近 AI 即時生成的遊戲地圖,而不是一張圖片或一段影片。
目前 Project Genie 仍然屬於 Google Labs 的研究原型產品。
主要使用條件包括:
至於 Street View 真實地點生成功能,早期部署主要集中在 美國地點,其他地區預計會逐步加入。
Project Genie 由 Google DeepMind 的 Genie 3 世界模型驅動。
與一般生成式 AI 不同,它不是輸出靜態內容,而是 直接生成可互動的世界。
主要技術特點包括:
技術上,系統會根據 之前生成的畫面 + 用戶行動預測下一個畫面,原理有點類似大型語言模型預測下一個詞語。
儘管展示效果吸引,Project Genie 仍然只是研究原型,存在不少限制。
已知限制包括:
因此目前更適合理解為 AI 研究展示與原型技術,而不是完整產品級模擬平台。
Google DeepMind 認為,像 Genie 這類 世界模型 AI 是通往更通用 AI 系統的重要一步。
潛在應用包括:
AI 可以從提示直接生成可玩的場景,未來或大幅加快遊戲地圖與世界設計流程。
如果結合 Street View 的真實地點,學生可以在互動模擬中探索城市、歷史地點或自然環境。
AI 與機械人需要大量模擬環境進行訓練,而 Genie 可以生成 幾乎無限數量的模擬世界作為訓練場。
大多數生成式 AI 工具主要創作 內容(文字、圖片、影片)。
但像 Genie 這類系統正在嘗試生成 完整且可互動的環境。
這種轉變意味著 AI 模型未來可以支持:
Project Genie 仍處於早期階段,但它展示了一個可能的未來:地圖、遊戲、模擬與 AI 訓練環境可能最終融合成同一種平台。