Google DeepMind 表示,其 Gemini Robotics 人工智慧模型的最新版本可以「控製完全人形機器人」。先前的模型專注於控制人形機器人的上半身, 雙子座機器人2 它現在支持從腳到指尖的“全身運動” 週四的公告。
新模型允許人形機器人執行多種動作,因為它允許它們行走、彎曲、伸展和操縱物體。 Google 分享的影片展示了 Apptronik 的 Apollo 2 機器人如何做到這一點 彎腰撿起 從水罐和架子上找到並拿起特定物品。
雖然Google DeepMind 聲稱其機器人將“在移動速度上進一步進步”,但它補充說,此次更新是“朝著完成更複雜、需要全身協調的現實世界任務所需的技能邁出的重要一步”。
此外,Gemini Robotics 2 支援提高靈活性,因為它現在可以控制更複雜的五指手。它允許機器人執行諸如關閉拉鍊、繫上垃圾袋或擰開燈泡等任務。
谷歌也更新了 DeepMind Gemini Robotics ER(體現推理),這是一個視覺語言模型,可以幫助機器人分析環境、處理指令並執行多步驟任務。 Gemini Robotics ER 2 能夠更好地完成較長時間的任務,現在可以了解「任務何時開始和結束」。
Google DeepMind 表示,此次更新還將允許多個不同類型的機器人協同工作並完成任務 一個視頻 阿波羅 2 號展示了它如何指示谷歌的雙臂機器人在清潔車庫時將工具分類。
該公司表示,Gemini Robotics ER 2 是其“迄今為止最安全的機器人模型”,因為它可以“更好地檢測人類何時在附近,啟動安全工具調用,並在有人離得太近時安全地關閉機器人。”
同時,Google DeepMind 對其 Gemini Robotics 設備上模型進行了改進,該模型可以在沒有網路連線的情況下在機器人上本地運行。該模型現在可以快速適應新的化身,包括「完全不同的形狀、感測器和自由度」。










