Google DeepMind发布Gemini Robotics 2,将多模态理解进一步延伸到真实世界中的机器人全身控制、精细操作和多机器人协作。
新系统由Gemini Robotics 2、Gemini Robotics ER 2和Gemini Robotics On-Device 2三类模型组成,分别负责视觉语言到动作控制、具身推理与任务编排,以及设备端低延迟运行。官方演示显示,机器人可以完成行走、弯腰、抓取、整理房间等连续任务,并能由不同机器人协同完成复杂流程。nn这次升级的意义在于,机器人不再局限于预先编排的固定动作,而是可以根据环境、目标和执行反馈持续推理。设备端模型还可用较少样本适配新的机器人形态,为家庭服务、工业协作和实验自动化提供了新的技术路径。
LUOJINGAI观察
这项更新反映出AI产品正持续向专业化、智能体化和真实场景执行演进。用户在选择相关工具时,应结合实际需求评估可用地区、费用、数据隐私和输出授权。
信息来源:Google DeepMind官方发布(原始发布日期:2026-07-30)
暂无评论...
