動察 Beating AI 快訊,世界模型公司 Odyssey 正式發布 Odyssey-3,並開放 Flash 版免費試玩。它能從文字實時生成可探索的世界。用戶走動、轉動鏡頭,畫面就跟著變化。團隊還展示了將同一模型用於機械臂、人形機器人、汽車和遊戲角色的實驗。
Odyssey-3 先從互聯網視頻、遊戲操作錄像和物理模擬中學習物體運動與動作後果。用於機器人或汽車時,預訓練主模型參數不變。團隊只需額外訓練小型控制模塊,將模型學到的知識轉化為操作指令。不同機器仍需單獨適配,但不必重新訓練整套模型。
Odyssey 僅用 20 小時模擬駕駛數據訓練專用控制模塊,就讓汽車在印度真實公路上行駛。測試中,模擬數據訓練方案在兩次安全員接管之間的行驶距離,約為真實駕駛錄像訓練方案的 77%。
與 Flexion 合作的人形機器人,使用數十小時遙控示範數據訓練後,能在光照變化下繼續執行任務。遊戲實驗中,控制模塊學習約 2 小時《GTA V》操作錄像。之後無需額外訓練,就能在《荒野大鏢客2》中讓角色騎馬移動。
在 Physics-IQ Verified 物理視頻預測測試中,Odyssey-3 Pro 獲得 66.1 分,超過 FLUX 3 [large] 的 64.35 分,均為 8 次擇優成績。Odyssey 還公布了 WorldMark 評測結果,模型在四類交互場景中取得三項第一。