Project Genie: Google 的實驗性無限互動世界生成器

Project Genie: Google 的實驗性無限互動世界生成器

Ryan Mitchell
89
original

Google DeepMind 推出 Project Genie 實驗原型,允許 AI Ultra 訂閱者在瀏覽器中建立並探索無限生成的互動世界。該技術基於遊戲引擎與擴散模型,實時生成場景與物理規則,帶來類似《我的世界》但完全由 AI 驅動的體驗。目前僅限美國使用者測試,但展示了生成式 AI 在虛擬世界構建領域的巨大潛力。

Google DeepMind 最近放出了一個很有意思的實驗專案——Project Genie,目前只對美國地區的 Google AI Ultra 訂閱者開放。你可以把它理解成一個由 AI 實時生成的、無限大的互動世界。聽起來有點抽象?實際玩一下就能明白:你輸入一段文字描述,比如「一片漂浮在雲中的森林,有小溪和石橋」,幾秒鐘後,一個可互動的 3D 場景就會出現在瀏覽器裡,你甚至能用 WASD 鍵在裡面走動。

技術核心:遊戲引擎與擴散模型的結合

Project Genie 不是簡單的文字轉 3D 模型。它背後是一個經過專門訓練的世界模型,融合了 遊戲引擎的物理規則擴散模型的視覺生成能力。傳統方法要麼只能生成靜態場景,要麼需要大量手工建模。Genie 的做法是:用大量遊戲視訊資料訓練一個基礎模型,讓它學會「世界應該怎麼運轉」——比如重力、碰撞、植被分佈。然後在每次生成時,模型會結合使用者提示,實時推斷出下一幀的畫面和可互動元素。

這種思路讓 Genie 生成了真正「可玩」的環境:你可以推動石塊、收集物品,甚至觸發簡單的機關。雖然目前生成的物體邊界還比較模糊,物理反饋也有些延遲,但考慮到它是完全由神經網路實時驅動,已經相當驚人了。

使用體驗:門檻極低,但限制不少

參與測試的門檻很低——只需要是 Google AI Ultra 月費訂閱者(每月 19.99 美元),並在美國地區。開啟網頁後,你會看到一個類似聊天介面的輸入框,輸入任何場景描述即可。生成過程大約需要 10-20 秒,之後就能用滑鼠鍵盤探索。

  • 優點:無需任何 3D 建模技能,自然語言即可創造世界;場景無限大且持續生成;支援基礎的物理互動。
  • 缺點:目前只能生成自然環境(森林、沙漠、水下等),無法建立城市或複雜建築;互動限於移動和基礎物體操作;畫質類似 2010 年左右的遊戲;必須聯網且僅限桌面瀏覽器。

實際影響:對哪類人值得關注?

對於 遊戲獨立開發者教育工作者 來說,Project Genie 預示著一個未來:用自然語言快速搭建遊戲原型或教學場景。儘管現在的版本還非常粗糙,但 DeepMind 將其定義為「研究原型」,下一步方向很可能是提升保真度和互動複雜度。如果你在關注 AI 輔助內容生產,這絕對是一個值得跟蹤的專案。

不過也要潑點冷水:Google 經常釋出實驗專案後不了了之。Genie 目前沒有公開的釋出路線圖,也沒有商業化承諾。把它當做一次有趣的技術預覽就好,別急著押注。

實用建議

  1. 想嚐鮮的話:先檢查自己是否是 Google AI Ultra 訂閱者(體驗無需額外付費),準備好一個清晰的場景描述,比如「日落時的沙漠,有仙人掌和綠洲」。
  2. 別期望成品級質量:Genie 的生成風格有點畫素化,物理引擎也不完美,更適合快速靈感驗證,而非直接產出最終素材。
  3. 關注後續迭代:如果 DeepMind 開放更復雜的場景生成(比如室內或機械結構),或者降低推理延遲,這可能會改變遊戲原型製作的工作流。

總的來說,Project Genie 讓我們瞥見了生成式 AI 的下一個前沿——不再是靜態圖片或視訊,而是活生生的、可以進入的世界。雖然還很不成熟,但這個方向本身已經足夠令人興奮。

Project GenieGoogle DeepMindAI 世界生成互動世界3D 場景生成AI Ultra實驗性專案遊戲原型世界模型擴散模型

分享

評論

0
0/500 字元

暫無評論

成為第一個評論的人

探索更多