專題:2026世界機器人大會論壇
2026世界機器人大會論壇於8月19日-22日在北京舉辦,京東集團技術委員會主席、京東雲總裁曹鵬表示,機器人還在爆發的前夜,原因在於整個機器人以及具身模型,它對於任務理解、泛化性相關的能力還是存在一些不足。

「比如在我們的實驗場、京東物流的部分場景當中,在某些特定標準任務下,機器人已經可以做到和人持平,不管是效率還是成本方面,都已經非常接近人工。但是沒辦法規模化複製到更多、更復雜的場景裏面去。」他說。
他指出,原因就是模型的泛化性不好。而模型泛化性不好,是因為沒有足夠的數據用來訓練模型,所以機器人目前只能侷限在部分具體場景中使用,沒辦法實現規模化複製。行業內普遍認為,如果要訓練出一個可以規模化複製、泛化能力優秀的機器人大腦,需要千萬小時級別的數據量。
但是目前行業能夠供給模型訓練的數據只有 10 萬小時這個量級,中間存在巨大的數據缺口,除此之外還存在本體採集的數據,跨本體泛化適配難等一系列問題。
所以他認為,未來制約機器人發展的是它的大腦,也就是大腦的泛化能力能不能達標,而大腦能不能足夠智能,關鍵在於我們有沒有充足的數據去供給模型訓練。
因此京東做出一個決定,下一階段要開展全球最大規模的數據採集任務,目標是在兩年以內,要採集超過一千萬小時的高質量人類真實場景的行為數據,同時採集超過 100 萬小時的機器人本體的運行數據。
「這項行動計劃,會覆蓋京東內部各類員工、外部行業從業人員、城市中的市民等方方面面,會發動超過十萬人去參與這項計劃。所有的數據採集一定都是基於合法合規,在能夠保證數據安全可靠的模式下開展。我們希望能夠通過這項計劃,為具身智能這個行業提供一套可持續的數據基礎設施。」他說。
新浪聲明:所有會議實錄均為現場速記整理,未經演講者審閱,新浪網登載此文出於傳遞更多信息之目的,並不意味着讚同其觀點或證實其描述。