Google發佈新一代機器人AI模型,實現人形機器人全身控制

AI速讀
Google DeepMind 發佈 Gemini Robotics 2 模型,成功將 AI 能力延伸至物理世界,實現人形機器人的全身協調控制,能自主繞障並執行拾取物體等任務。儘管該技術標誌著 Google 重回機器人賽道並與 OpenAI、英偉達競爭,但官方坦承機器人目前的反應速度與靈活性仍有提升空間,商業化落地仍需時日。市場對此反應平淡,Google 週四盤中下跌 1.4%。
GoogleDeepMind發佈新一代機器人AI模型Gemini Robotics 2,實現對整個人形機器人實施從頭到腳的全身控制。其還同步發佈了另外兩款機器人AI模型——Gemini Robotics ER 2與On-Device 2,兩者可協同工作或獨立運行,支援規劃多步驟任務及協調多臺機器人作業。

Alphabet旗下Google DeepMind推出新一代機器人人工智慧模型Gemini Robotics 2,使人形機器人實現全身動作協調,標誌著這一科技巨頭在將AI能力延伸至物理世界的競賽中邁出重要一步。

新模型支援機器人在執行推理任務的同時完成行走、蹲伏和物體操控等動作。與前代產品主要控制機器人上半身不同,Gemini Robotics 2可對整個人形機器人實施從頭到腳的全身控制。

在本周二面向媒體的預錄演示中,該模型控制Apptronik公司的Apollo人形機器人完成了穿越房間、拾取澆水壺並放置至低層架子的全流程操作,期間機器人自主繞開了障礙物。

與此同時,Google DeepMind還同步發佈了另外兩款機器人AI模型——Gemini Robotics ER 2與On-Device 2,兩者可協同工作或獨立運行,支援規劃多步驟任務及協調多臺機器人作業。

截至發稿,周四盤中,Google下跌1.4%。

全身控制能力實現突破,但真正靈活性仍是遠期目標

Google DeepMind機器人部門副總裁Carolina Parada在新聞發佈會上表示:"我們的目標是將AI帶入物理世界,並構建一個可供每臺機器人使用的智能層。"

不過,Google DeepMind機器人部門總監Kanishka Rao同時坦承,真正意義上的靈活性仍是遙遠目標。

機器人動作目前仍顯緩慢且刻意,原因在於機器必須停下來思考人類憑直覺便能做出的判斷。這一表態為外界對人形機器人商業化落地的預期提供了更為審慎的參照。

延續2025年佈局,重燃十年機器人雄心

此次發佈是Google今年機器人戰略的延續。2025年,Google推出了初代Gemini Robotics,該版本能夠將語言和視覺資訊轉化為機器人動作,重新點燃了這家公司長達十餘年的機器人抱負。

這一方向對Google而言並非全新賽道,但此前歷經反覆。

Alphabet在2010年代初期相繼收購多家機器人初創公司後,後來大幅收縮相關業務,並於2023年關閉了旗下Everyday Robots部門。此次連續推出新一代模型,顯示其在該領域的投入再度升溫。

Google面臨來自同行的直接競爭。OpenAI正在探索融合視覺、語言與動作的通用機器人基礎模型,而輝達則為開發者提供用於訓練AI驅動機器人的軟件工具。 (華爾街見聞)