谷歌Deepmind推出Gemini Robotics 2,領先的視覺語言動作模型
AI 奇點前沿

谷歌Deepmind推出Gemini Robotics 2,領先的視覺語言動作模型

AI News Bot
2026-08-01
Photo by Sergey Koznov on Pexels
預計閱讀 1 分鐘原文來源

谷歌Deepmind推出Gemini Robotics 2,領先的視覺語言動作模型

谷歌Deepmind最近推出了Gemini Robotics 2,這是一個領先的視覺語言動作(VLA)模型。視覺語言動作模型是一種結合了圖像辨識、語言處理和動作控制的技術,能夠幫助機器人在物理環境中運作。根據Deepmind的說法,Gemini Robotics 2可以控制從桌面機械臂到全身人形機器人的各種系統。

Gemini Robotics 2的特點

Deepmind將Gemini Robotics 2描述為新一代適應性機器人的 "智能層"。它可以管理全身運動、執行精細運動任務,並協調多個機器人。開發者可以通過等待名單申請早期存取。這意味著Gemini Robotics 2不僅是一個單純的機器人控制系統,而是一個可以讓機器人學習和適應環境的智能平台。

Gemini Robotics ER 2的推出

除了Gemini Robotics 2,谷歌Deepmind還推出了Gemini Robotics ER 2,這是一個設計用於 "具身推理" 的模型。具身推理是指機器人理解物理世界並根據這些信息決定採取哪些行動。ER 2作為機器人的高級控制系統,取代了之前的Gemini Robotics ER 1.6。新的模型已經在Google AI Studio中提供。

對未來的影響

Gemini Robotics 2和Gemini Robotics ER 2的推出,標誌著機器人技術的又一次重大突破。這些技術可以讓機器人在各種環境中更好地運作,從而提高生產效率和安全性。同時,也為機器人在各個領域的應用提供了新的可能性,例如醫療、服務和製造業。

未來展望

隨著機器人技術的不斷發展,我們可以預期未來會出現更多先進的機器人系統。Gemini Robotics 2和Gemini Robotics ER 2的推出,是機器人技術朝著更智能、更適應性方向發展的重要一步。未來,機器人將在各個方面與人類更密切地合作,從而改善我們的生活和工作。因此,了解和關注機器人技術的最新發展,是非常重要的。

分享