上海交大等提出 REAL 具身智能体框架,入选 ECCV 2026
REAL 让机器人在没有「上帝视角」的特权感知、指令又模糊时,边探索边追问边操作,还能零样本迁移到真机。
真实家庭任务常从信息不完整开始:机器人不知道目标在哪,用户也说不清想要什么。上海交大与上海人工智能实验室等提出 REAL——一套面向开放世界移动操作的具身智能体(能感知并动手操作物理环境的 AI)框架,把主动探索、意图消歧与物理操作统一进同一个决策闭环,并完成真机部署验证。
正文摘录
.jpg)  真实家庭任务往往从「不完整的信息」开始:机器人不知道目标在哪里,用户也未必能一次说清自己想要什么。面对「帮我从餐桌上拿点零食」这样的模糊指令,机器人不仅要主动寻找候选物体,还要在发现面包和多个甜甜圈后进一步询问用户,确认究竟该拿哪一个。 在真实世界里,探索环境、理解意图和执行动作,本就不是三个彼此独立的问题。 围绕这一问题,来自上海交通大学、上海人工智能实验室等机构的研究者提出 REAL,一个面向开放世界移动操作的可探索、可交互、可部署的视觉具身智能体框架,并构建了贯穿仿真、数据生成、模型训练、系统评测与真机部署的完整技术链路。这篇工作已被 ECCV 2026 接收。