AI News HubLIVE
站內改寫1 分鐘閱讀

Google DeepMind新AI模型可控制機器人全身

Google DeepMind發佈Gemini Robotics 2,將控制範圍從上半身擴展至全身運動,包括行走、蹲下、伸展等,並支持五指手進行精細操作,如密封拉鍊袋、擰燈泡等。同時升級了具身推理模型ER 2,提升了長時間任務完成能力和安全性,支持多機器人協作,並改進了設備端模型。

來源The Verge AI作者: Emma Roth

Google DeepMind於週四宣佈,其最新版Gemini Robotics AI模型“能夠控制完整的人形機器人”。與先前僅控制上半身的版本不同,Gemini Robotics 2現在支持從腳趾到指尖的“全身運動”,使機器人能夠執行更廣泛的動作。

新模型允許人形機器人行走、蹲下、伸展並操縱物體。Google分享的視頻顯示,Apptronik的Apollo 2機器人可以彎腰撿起噴壺,還能從架子上找到並取下特定物品。儘管DeepMind指出機器人在“運動速度上仍有待提升”,但這次更新是“朝着完成需要全身協調的複雜現實任務邁出的重要一步”。

Gemini Robotics 2還提高了靈巧性,現在能控制更復雜的五指手,從而執行諸如密封拉鍊袋、系垃圾袋或擰燈泡等任務。這些能力的提升使得機器人能夠應對更多日常操作場景。

與此同時,DeepMind還升級了Gemini Robotics ER(具身推理)視覺語言模型,幫助機器人分析環境、處理指令並執行多步驟任務。新版ER 2在長時間任務上表現更佳,並“理解任務的開始和結束”。該更新還允許多個不同類型的機器人協同工作,例如Apollo 2在清理車庫時指揮雙臂機器人將工具放入垃圾箱。

在安全方面,DeepMind稱Gemini Robotics ER 2是“迄今為止最安全的機器人模型”。它能夠更好地檢測人類靠近,觸發安全工具調用,並在有人過於接近時使機器人安全停止。此外,改進後的Gemini Robotics On-Device Model可在無網絡連接的情況下本地運行,並更快適應不同外形、傳感器和自由度的機器人。