8月17日,具身智慧初創公司共生知行(Symbiosis Robotics) 釋出了雙足人形機器人駕駛卡丁車的Demo,並同步上線官方網站。這是公司成立以來首次較為完整地對外展示技術方向和階段性研發成果。

公開影片中,人形機器人進入卡丁車駕駛位,雙手接觸方向盤、雙腳進入踏板區域,並在封閉賽道上完成車輛行駛。駕駛並非單一動作:機器人需要根據環境調整方向,在狹窄座艙中保持穩定,並協調手部轉向與腳部油門、剎車控制。共生知行將這段賽車Demo定義為一次面向全身智慧的綜合測試,強調“卡丁車不是應用本身,而是一場全身智慧壓力測試”。卡丁車並非其商業應用方向,公司希望借這一場景,把視覺感知、多接觸點平衡、手眼腳協同和精細力控放進同一條連續任務鏈,檢驗機器人能否像人一樣調動全身完成複雜物理互動。

當前公開展示多聚焦行走、奔跑等運動能力,或固定位置的上肢抓取。前者考驗本體和運控,後者考驗視覺與機械臂操作;一旦需要同時保持平衡、理解環境並連續操作,模型、運控和硬體的耦合顯著增加。這正是人形機器人從“能運動”走向“能完成任務”的難點。圍繞這一問題,共生知行將自身定位為面向雙足人形機器人的全身智慧基座模型公司,探索從視覺等感知資訊到機器人全身動作輸出的端到端技術路線。公司希望減少傳統分層架構中多個模組之間的資訊損失和適配成本,使模型更直接地學習身體、環境與動作之間的關係,並通過擴大數據規模獲得跨任務能力。

端到端也不意味著通用能力已經實現,它仍需要資料、底層控制、真機訓練基礎設施和嚴格評測共同支撐。因此,賽車Demo更適合被視為階段性驗證,而不是機器人已具備通用駕駛能力的證明。公司表示,後續將通過技術報告披露模型架構、測試條件和評測方式。

對於一家成立時間不長的公司,外界更關心的是:團隊為什麼有能力同時推進模型、運動控制和資料鏈路?共生知行的核心成員來自智源研究院、港科大、極佳視界、小米、達摩院、螞蟻、清華等機構,均為博士研究者。幾位成員創業前已持續合作兩年以上,研究覆蓋視覺—語言—動作模型(VLA)、全身運動控制、力位統一控制、跨本體學習及資料利用。在可公開核驗的成果中,創始人丁鵬翔參與的ReconVLA獲得AAAI-26傑出論文獎;其主導的VLA-Adapter嘗試以更小的模型和訓練成本實現VLA能力,開源專案在GitHub已獲得超過2200顆星。團隊還曾發起並運營OpenHelix Robotics開源社群,已公開多個VLA及具身智慧專案。相比單篇論文或一次Demo,這些橫跨模型、資料和運動控制的積累,更能說明公司希望建立的競爭力:不是隻為一個場景編排動作,而是形成能夠持續訓練、驗證和迭代全身智慧模型的研發鏈條。

公司表示,未來將快速迭代釋出共生知行的技術進展、Demo、開源專案和研究報告等。賽車只是第一項公開測試,未來還將圍繞移動操作、高精度視覺對準、接觸式力控和長鏈條任務推出更多案例。對仍處早期階段的雙足人形機器人行業而言,一段影片無法回答模型通用性、任務成功率和規模化部署等全部問題。但它至少提出了一個值得觀察的方向:競爭正在從“本體能否做出動作”,轉向“模型能否調動全身,在真實環境中持續完成任務”。共生知行能否把技術積累轉化為可擴充套件的模型能力,仍需後續技術披露和更多可復現結果驗證。