谷歌 DeepMind 于 2026 年 7 月 30 日发布 Gemini Robotics 2 系列模型,首次实现对完整人形机器人的全身智能控制。系列包含三个模型:视觉-语言-动作模型可控制人形机器人从脚到指尖完成行走、下蹲、抓取等动作;具身推理模型 ER 2 作为机器人的「高层大脑」,可规划持续数分钟、涉及数百次决策的多步任务;端侧模型可本地运行,仅需几小时、通常不到 200 个示例即可适配全新机器人本体。
新模型还支持多机器人协作,不同类型机器人可协同完成单机无法胜任的复杂任务。ER 2 已通过 Gemini API 和 Google AI Studio 向开发者开放,VLA 与端侧模型面向早期合作伙伴提供。团队同时推出 ASIMOV-Agentic 安全基准,ER 2 可在有人靠近时让机器人自动安全停止。
Google DeepMind | Google
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel