一句話總結:Google 全新推出的 Gemini Robotics ER 2,讓機器人具備更強大的即時情境感知和多機器人協作能力,真正邁向「高階大腦」時代。
核心要點
- 加入連續影片理解能力: 讓機器人能夠即時分析攝影機畫面,判斷任務完成進度。
- 進度分類功能: 將影片中的每一個畫面依任務完成程度分為五個階段,提高工作準確率。
- 關鍵時刻辨識: 可找出任務完成的關鍵時間點,準確率達 91.3%。
- 多機器人協作: 不同類型的機器人可共享語意理解能力,分工合作完成複雜任務。
- 提升空間理解能力: 包括成功/失敗偵測、儀器讀值、視覺問答等核心功能。
從產業面來看
Google 推出 Gemini Robotics ER 2,不僅是技術上的重大突破,更是機器人產業的一次質變。過去的機器人多數僅具備基本的空間推理能力,而 Gemini Robotics ER 2 通過加入連續影片理解、進度分類、關鍵時刻辨識等功能,真正實現了「高階大腦」的概念。這意味著機器人不再只是簡單的工具,而是能夠自主判斷、調整策略,甚至與人類進行自然對話的智能助手。
安全性與應用前景
Gemini Robotics ER 2 在安全性方面也有顯著提升,特別是在人員接近偵測和安全指令遵循兩項測試中,表現優於前一代模型。這使得機器人在工業、醫療、家庭等場景中的應用更加廣泛。此外,Google 也展示了與波士頓動力的合作成果,通過整合 Spot 四足機器人的導航 API 和機械手臂控制能力,實現了更自然的任務執行。開發者可以通過 GitHub 獲得相關範例程式,進一步探索其應用潛力。
行動呼籲
隨著 Gemini Robotics ER 2 的推出,機器人產業迎來了新的里程碑。對企業來說,這是一個提升生產效率和創新能力的機會;對開發者來說,則是一次探索前沿技術的契機。如果你對這項技術感興趣,不妨前往 Google AI Studio,體驗 Gemini Robotics ER 2 的強大功能。
本文改寫整理自公開新聞來源,原始報導由自由時報發布。
常見問題 FAQ
Gemini Robotics ER 2 的主要突破有哪些?
Gemini Robotics ER 2 的主要突破包括加入連續影片理解能力、進度分類功能、關鍵時刻辨識、多機器人協作以及提升空間理解能力。
Gemini Robotics ER 2 在安全性方面有哪些提升?
Gemini Robotics ER 2 在人員接近偵測和安全指令遵循測試中表現優於前一代模型,能夠自動停止作業、監測環境並在必要時恢復工作。
如何獲取 Gemini Robotics ER 2 的開發資源?
開發者可以通過 Google AI Studio 使用 Gemini API,或在 GitHub 上獲得相關範例程式。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。