行业新闻

Google DeepMind 的 Keerthana 谈 Gemini Robotics 2:跨本体与全身控制

Google DeepMind 的 Keerthana 谈 Gemini Robotics 2:跨本体与全身控制

DeepMind 如何用「推理模型 + 视觉-语言-动作执行」的架构做机器人大脑,以及在延迟、传感器故障和安全上的真实取舍。

嘉宾Keerthana Gopalakrishnan

节目简介

Google DeepMind 的 Gemini Robotics 研究负责人 Keerthana Gopalakrishnan 谈 Gemini Robotics 2 的发布、全身智能与通用人形机器人。她把 Gemini Robotics ER 2 这类推理模型和视觉-语言-动作执行层配对使用,并指出多指操作和跨本体(同一套模型驱动不同形态机器人)比双足行走更难解决。两人还讨论了物理 AI 进入人类环境的现实代价:推理延迟、传感器失效、以及出错就会造成身体伤害的安全问题。

阅读原文(cognitiverevolution.ai)→

行业新闻Erik Torenberg, Nathan Labenz2026-10-03原文

相关内容