Boston Dynamics Spot 與 Gemini Robotics ER 2:取物展示解析
Spot 取物展示中,ER 2 負責高層計劃、API 選擇和進度確認,Spot 原有的導航、機械臂介面與控制器負責實際移動和抓取。
VLA、VLM、機器人基礎模型與通用控制模型。
Spot 取物展示中,ER 2 負責高層計劃、API 選擇和進度確認,Spot 原有的導航、機械臂介面與控制器負責實際移動和抓取。
ER 2 標準版與流式版都有免費層,付費輸入和輸出分別為每百萬 token 2 美元與 10 美元;兩者支援的工具和通訊方式不同。
On-Device 2 在機器人本地讀取指令、影像和本體狀態,輸出數值動作;它不是公開 Gemini API 模型,目前僅面向 Trusted Testers。
Gemini Robotics ER 2 是面向機器人的高層視覺語言模型,負責理解環境、規劃步驟、呼叫工具和跟蹤進度,不直接輸出馬達動作。
將 GR00T N1.7 理解為早期存取的 3B 視覺-語言-動作模型,包括架構、資料格式、適配和硬體評估,並整理真實機器人部署前需要核對的條件、指標與失敗證據。
Google 的物理 AI 版圖涵蓋 Gemini Robotics、具身推論、世界模型、資料與機器人合作。本文整理各層角色與證據邊界。