Google DeepMind 最近放出了一個很有意思的實驗專案——Project Genie,目前只對美國地區的 Google AI Ultra 訂閱者開放。你可以把它理解成一個由 AI 實時生成的、無限大的互動世界。聽起來有點抽象?實際玩一下就能明白:你輸入一段文字描述,比如「一片漂浮在雲中的森林,有小溪和石橋」,幾秒鐘後,一個可互動的 3D 場景就會出現在瀏覽器裡,你甚至能用 WASD 鍵在裡面走動。
技術核心:遊戲引擎與擴散模型的結合
Project Genie 不是簡單的文字轉 3D 模型。它背後是一個經過專門訓練的世界模型,融合了 遊戲引擎的物理規則 和 擴散模型的視覺生成能力。傳統方法要麼只能生成靜態場景,要麼需要大量手工建模。Genie 的做法是:用大量遊戲視訊資料訓練一個基礎模型,讓它學會「世界應該怎麼運轉」——比如重力、碰撞、植被分佈。然後在每次生成時,模型會結合使用者提示,實時推斷出下一幀的畫面和可互動元素。
這種思路讓 Genie 生成了真正「可玩」的環境:你可以推動石塊、收集物品,甚至觸發簡單的機關。雖然目前生成的物體邊界還比較模糊,物理反饋也有些延遲,但考慮到它是完全由神經網路實時驅動,已經相當驚人了。
使用體驗:門檻極低,但限制不少
參與測試的門檻很低——只需要是 Google AI Ultra 月費訂閱者(每月 19.99 美元),並在美國地區。開啟網頁後,你會看到一個類似聊天介面的輸入框,輸入任何場景描述即可。生成過程大約需要 10-20 秒,之後就能用滑鼠鍵盤探索。
- 優點:無需任何 3D 建模技能,自然語言即可創造世界;場景無限大且持續生成;支援基礎的物理互動。
- 缺點:目前只能生成自然環境(森林、沙漠、水下等),無法建立城市或複雜建築;互動限於移動和基礎物體操作;畫質類似 2010 年左右的遊戲;必須聯網且僅限桌面瀏覽器。
實際影響:對哪類人值得關注?
對於 遊戲獨立開發者 和 教育工作者 來說,Project Genie 預示著一個未來:用自然語言快速搭建遊戲原型或教學場景。儘管現在的版本還非常粗糙,但 DeepMind 將其定義為「研究原型」,下一步方向很可能是提升保真度和互動複雜度。如果你在關注 AI 輔助內容生產,這絕對是一個值得跟蹤的專案。
不過也要潑點冷水:Google 經常釋出實驗專案後不了了之。Genie 目前沒有公開的釋出路線圖,也沒有商業化承諾。把它當做一次有趣的技術預覽就好,別急著押注。
實用建議
- 想嚐鮮的話:先檢查自己是否是 Google AI Ultra 訂閱者(體驗無需額外付費),準備好一個清晰的場景描述,比如「日落時的沙漠,有仙人掌和綠洲」。
- 別期望成品級質量:Genie 的生成風格有點畫素化,物理引擎也不完美,更適合快速靈感驗證,而非直接產出最終素材。
- 關注後續迭代:如果 DeepMind 開放更復雜的場景生成(比如室內或機械結構),或者降低推理延遲,這可能會改變遊戲原型製作的工作流。
總的來說,Project Genie 讓我們瞥見了生成式 AI 的下一個前沿——不再是靜態圖片或視訊,而是活生生的、可以進入的世界。雖然還很不成熟,但這個方向本身已經足夠令人興奮。











評論
暫無評論
成為第一個評論的人