新浪科技訊 8月24日下午消息,2026世界機器人大會(WRC)期間,火山引擎具身智能技術與應用論壇召開。論壇上,火山引擎具身智能產品線負責人王運凱在活動中發表演講,介紹火山引擎面向具身產業的賦能思路與實際落地情況。
在他看來,當前具身行業首要瓶頸已經從數據總量轉向數據質量。「EGO和UMI的確已經起量,但是它起到這個量之後質量怎麼樣纔是一個關鍵。」他提到,部分百萬小時原始數據集實際有效信息量可能僅相當於十萬小時。
從這個角度,目前火山引擎搭建起覆蓋數據全流程的工具鏈。據他描述,豆包大模型被很多頭部企業用來完成數據切片與細粒度幀級打標,支撐企業每月數十萬量級的數據處理需求;Seedance模型可以實現生成第三視角畫面、裸手圖像替換為機械臂等數據增廣工作;SimReady基於Seed 3D生成仿真資產,並補齊語義標籤、物理屬性,使其可以直接用於仿真環境。
交互能力方面,豆包已落地端到端S2S語音方案,並將持續推進全模態模型研發,計劃探索一款可交互、可探索的世界模型。王運凱同時透露,今年春晚舞台上基本上所有具身機器人的交互能力,背後頭部合作廠商均採用豆包模型。