香港即時新聞網
具身AI欠標準難公平比較 港大牽頭跨國專家建統一評測基準
來源 : 東方
更新 : 2026-08-12 17:03
具身人工智能(Embodied AI)技術近年發展迅速,惟缺乏統一評測標準,令各款機械人難以公平比較。香港大學多媒體實驗室推出全球首個結合模擬環境與真實世界機械人操作的統一評測基準平台RoboDojo。評測結果顯示,現時表現最佳的模型於真實測試的成功率僅得12.8%,遠低於人類專家的100%,反映AI機械人要走向日常應用仍有巨大進步空間。 具身人工智能旨在賦予機械人在實體環境感知及採取行動的能力,惟現有評測大多局限於模擬環境,或因硬件與測試條件不同而缺乏公平標準。RoboDojo將模擬評測、標準化真實測試及策略模型比較整合,目前涵蓋42項模擬任務、18項真實任務及30個代表性策略模型,全面評估機械人的泛化、記憶及精細操作等能力。 測試揭示現行技術瓶頸,最佳模型於模擬及真實環境的成功率分別只有8.8%及12.8%,相比人類專家的76.03%及100%相去甚遠。港大計算與數據科學學院副院長羅平指RoboDojo是首個由本港牽頭、結合模擬與標準化真實評測的基準平台,有助推動研究由示範成果邁向可量度及可信賴的進步。
已複製
https://www.headline4hk.com/article/20260812/oncc/bkn-20260812160542397-0812_00822_001/
具身AI欠標準難公平比較 港大牽頭跨國專家建統一評測基準
具身AI欠標準難公平比較 港大牽頭跨國專家建統一評測基準
