最新版本的 Project Genie 與 Google Maps 的 Street View 資料庫結合,使 AI 能以現實世界影像作為基礎生成互動環境。
在實際操作上,流程大致如下:
完成後,使用者就能像在玩遊戲一樣 在該地點的 AI 模擬版本中移動與探索。
因為環境是即時生成的,場景也可以被重新想像,例如:
這些變化都能透過提示指令完成。
Project Genie 更像是一個 互動式世界生成工具,而不是單純的影像生成器。
目前已展示的能力包括:
因此它更像是 AI 自動生成的遊戲關卡或模擬場景,而不是一張圖片或影片。
Project Genie 目前仍是 Google Labs 的實驗性原型產品。
主要存取條件包括:
至於 Street View 生成世界的功能,目前部署仍 主要集中在美國地點,未來可能逐步擴展到其他國家。
Project Genie 的核心是 Google DeepMind 的 Genie 3 世界模型。
與傳統生成式 AI 不同,它不是產生固定媒體,而是生成 可互動的環境本身。
主要技術特點包括:
從技術角度看,系統會根據 先前畫面與使用者動作預測下一個畫面,就像大型語言模型預測下一個文字 token 一樣。
儘管展示效果相當驚人,Project Genie 仍是一個早期研究原型。
目前已知限制包括:
因此目前更適合被視為 研究實驗平台,而不是成熟的模擬或遊戲引擎。
DeepMind 將 Genie 視為邁向更通用 AI 系統的一個重要方向:讓 AI 不只生成內容,而是能 理解並模擬整個環境。
世界模型可能大幅加速遊戲開發流程,因為設計師可以透過提示快速生成可玩的環境,而不是完全手動建模。
若與 Street View 等真實資料結合,學生未來可能透過互動模擬探索城市、歷史地點或自然環境。
機器人與 AI 代理通常需要大量模擬環境訓練。Project Genie 能生成無限變化的世界,可能成為訓練場景的重要來源。
目前多數生成式 AI 工具主要產生 文字、圖片或影片。但像 Genie 這樣的世界模型,目標是生成 會持續運作並可互動的環境。
這種轉變意味著 AI 不只是創作內容,而是能建立完整的模擬系統,支援:
Project Genie 還在早期階段,但它已經展示了一個可能的未來:地圖、遊戲、模擬與 AI 訓練環境,最終可能融合成同一個 AI 平台。