跳到主要內容
AI News HubLIVE
站內改寫2 分鐘閱讀

面向部署後物理AI的持續現場自適應模型(CFAMs)

文章摘要

這篇論文提出持續現場自適應模型(CFAMs),讓機器人在部署後也能利用設備上的無梯度更新自主持續學習。CFAM採用凍結的慢速學習組件與快速學習的膠囊場;在機械臂、四足機器人、人形機器人、四旋翼和越野車上,僅用40%的完整訓練數據(2.5倍更少的軌跡)就達到標準策略的性能;自主獲取已驗證的近分佈外樣本可將動作成功率提高13.9個百分點,學習新技能時原有能力幾乎不受影響。

來源arXiv Robotics作者: Amarjot Singh, Tanmay R. Pancholi, Jainam Kothari, Shrirang Mahajan, Ketan Bansal, Zackory Erickson, Giuseppe Loianno, Alexandre M. Bayen, Jeff Schneider, Vince Nakayama
面向部署後物理AI的持續現場自適應模型(CFAMs)
報告錯誤

更正渠道尚未開通,可先複製下方文章資訊留存。

查看更正說明
直接讀正文

在許多關鍵任務場景中,人們希望機器能代替人類進入危險環境、使用人類工具完成工作,但這類“無人值守的交互式自主”目前仍是缺失的能力。困難在於:現場往往缺少訓練數據,系統只能使用機載計算,而部署後還必須應對新的情況,又不能忘記之前學會的技能。針對這一挑戰,Amarjot Singh等十位研究者於2026年9月3日向arXiv提交了論文《面向部署後物理AI的持續現場自適應模型(CFAMs)》(arXiv:2609.04552,主題分類cs.RO與cs.AI),提出CFAM方法。

CFAM的目標是在實驗室中高效學習,並在部署後繼續通過自主、無梯度、設備端更新來成長。其核心是一種互補學習架構:一側是凍結的慢速學習組件,用於保留長期穩定能力;另一側是快速學習的“膠囊場”(Capsule Field)。慢速組件包含三個皮層:Sensor皮層將多模態輸入映射為基於3D空間的幾何表示;Reasoning皮層將任務分解為技能並評估結果;Action皮層則執行這些幾何技能。膠囊場以一次性、無梯度的方式把現場學到的內容保存為“能力膠囊”(Competence Capsules)。技能安裝階段在實驗室只需少數示例,部署後則可持續進行;不過論文明確把開放世界的新奇事物排除在當前範圍之外。

實驗覆蓋了五種機器人形態:機械臂、四足機器人、人形機器人、四旋翼無人機和越野車。為了公平比較物理平台上的表現,pi0、CogACT和SpatialVLA等基線使用了同一套內部多形態數據集。結果顯示,CFAM只需完整訓練集40%的數據(即2.5倍更少的軌跡)即可達到用全部先前數據訓練的標準策略的運行點。測試時,自主採集經過驗證的近分佈外(near-OOD)案例使動作成功率提升了13.9個百分點。

論文還考察了順序學習中的遺忘問題。在順序仿真設置下,CFAM的後向遷移僅為-0.5個百分點,而LoRA為-11.4個百分點,説明CFAM在學習新技能時能更好地保持先前能力。論文總結認為,CFAM提供了一種有界的部署後物理智能:它支持小樣本技能學習、從經過驗證的近分佈外經驗中自主增長,並且不會明顯破壞已有能力。該論文的arXiv DOI目前正通過DataCite等待註冊。

展開要點與分析

文章情報

工程師進階

要點

  • CFAM結合凍結的慢速學習組件與快速學習的“膠囊場”,以一次性、無梯度的方式存儲和調用新技能。
  • 在機械臂、四足機器人、人形機器人、四旋翼無人機和越野車五種實體上完成評測,並與pi0、CogACT、SpatialVLA等基線比較。
  • 僅需完整先前訓練數據的40%(2.5倍更少的軌跡)即可達到標準策略的運行點。
  • 自主採集已驗證的近分佈外樣本使動作成功率提升13.9個百分點;順序仿真中的後向遷移為-0.5個百分點,明顯優於LoRA的-11.4個百分點。

要點與分析由自動化流程生成,可能有誤,請結合原始來源核實。