新浪科技訊 9月10日下午消息,近日,大曉機器人聯合南洋理工大學S-Lab等機構發布並開源統一多模態世界模型框架Puffin-World。作為面向空間智能與具身智能的成果,Puffin-World首次在一個統一多模態框架中,將物理、幾何和外觀定義為三種原生的三維世界狀態,並貫通重力場感知、自由視點空間仿真、三維世界生成與重建以及閉環探索,預測機器人行動後世界將處於什麼狀態。
據了解,Puffin-World同步開源代碼、模型和Puffin-16M數據集,包括1500萬組視覺—語言—相機三元組和100萬條具有挑戰性的旋轉軌跡,並開放覆蓋28個公開數據集、約4450萬張圖像的絕對相機位姿標註,為機器人仿真、合成數據生產與具身智能訓練提供可復現、可擴展的技術底座。