機器人初創公司 Generalist AI 於 8 月 20 日釋出了其最新 AI 模型 GEN-1.5,該模型能夠僅憑一次演示就讓機器人學會執行新任務,無需任何傳統意義上的訓練。據公司介紹,使用者只需提供一段 3 至 12 秒 的演示影片,該影片會被載入到模型的上下文視窗中,作為“物理提示”(physical prompt)——相當於模型的短期記憶。此後,機器人即可直接執行該任務,無需任何額外訓練。

在公司的內部測試中,GEN-1.5 在十項任務(如開啟罐子、從錢包中取錢等)上的平均成功率為 59%。如果使用五分鐘的資料進行十步訓練,成功率可提升至 83%。此外,該模型還支援將兩個提示串聯成更長的任務序列,並能利用模擬環境中的演示,以及部分模仿人類手部動作。

Generalist AI 表示,這些能力並非通過顯式訓練獲得,而是在超過八個月的互動資料預訓練過程中“自發湧現”的。公司聲稱,儘管其他研究團隊此前也展示過類似的上下文學習能力,但僅限於少數任務型別,而 GEN-1.5 是首個在廣泛任務範圍內實現這一功能的模型。

不過,值得注意的是,目前所有測試結果均來自公司自身,尚未經過獨立驗證。所展示的任務也相對簡單且耗時較短,因此該技術在複雜、長時程任務上的表現仍有待檢驗。

這一進展反映了具身智慧領域的一個新趨勢:通過大語言模型式的“上下文學習”來減少機器人程式設計和訓練成本。如果該技術得到驗證,可能對工業自動化、家庭服務機器人等領域產生深遠影響。然而,從實驗室演示到實際部署之間仍有相當距離,行業觀察者普遍認為,此類模型的泛化能力和可靠性仍需更多第三方驗證。