Alphabet旗下Google Deep Mind於本周正式推出新一代機械人人工智能(AI)模型Gemini Robotics2,該突破性進展使人形機械人具備了從頭到腳的全身動作協調能力,象徵著這家科技巨頭在將AI能力延伸至物理世界的競賽中,邁出了關鍵性的一步。
Gemini Robotics2最大的技術亮點在於其對人形機械人的控制範疇從過往局限的上半身,擴展至整體的全身控制。這意味著機械人在執行複雜推理任務的同時,能夠同步完成行走、蹲伏及靈活操控物體等高難度動作。
在近期向媒體展示的案例中,該模型成功操控Apptronik公司的Apollo人形機械人,完成了自主繞過障礙物、穿越房間、精準拾取澆水壺並將其放置於低層架子的全流程任務,展現出高度的自主協調性。
與此同時,Google Deep Mind還同步公開了Gemini Robotics ER2與On-Device2兩款配套模型。這兩款新產品既能獨立運作,亦可協同工作,旨在支援機械人規劃多步驟任務,並協調多台機械人共同執行作業,進一步完善了其機械人AI的軟件生態。
儘管此次發布展現谷歌在實體AI領域的強大實力,但公司內部對技術現狀保持著冷靜的審視。Google Deep Mind機械人部門副總裁Carolina Parada強調,公司的長遠目標是將AI引入物理世界,並構建一個通用且高效的機械人智能層。然而,機械人部門總監也坦承,追求真正意義上的機械人靈活性依然是一個長期的挑戰。目前,機械人動作過程仍顯緩慢與刻意,因為機器在執行動作前必須停下來處理與思考人類能憑直覺完成的判斷,這也為人形機械人商業化落地進程提供更為審慎的參考視角。

