具身智慧模擬評測平台RoboColiseum於近日正式上線,據介面新聞訊息,該平台定位為常態化模擬評測工具,旨在為具身智慧模型提供標準化的效能衡量環境。平台基於高保真模擬環境構建,官方實測顯示,其模擬評測結果與實機部署的相關性達到89.5%,意味著模擬測試能在較大程度上反映模型在真實場景中的表現。
RoboColiseum覆蓋指令跟隨、空間理解、擾動適應與通用操作四大維度,共包含78個任務,任務設計兼顧基礎能力與複雜場景。平台支援模型本地部署接入,使用者可快速完成評測,最快30分鐘即可輸出成績,降低了評測門檻。此外,平台已提供π0、GR00T等主流模型的基線結果,便於研究者進行復現與對比。
該平台的推出,為具身智慧領域缺乏統一評測標準的問題提供瞭解決方案。此前,各團隊常自建測試環境,結果難以橫向比較。RoboColiseum通過標準化任務和高效流程,有望推動模型迭代和行業交流。對於關注機器人AI發展的投資者而言,此類基礎設施的完善,可能加速技術落地程序,但具體影響仍需觀察實際使用情況。