行业新闻

智象未来发布具身世界模型 HiDream-O1-Embodied,登顶扰动适应评测榜

智象未来发布具身世界模型,用抗干扰能力登顶专业评测榜,让 AI 从视频生成走向真实物理操作。

具身世界模型让 AI 从「看懂视频」进阶到「操控实物」。智象未来发布的 HiDream-O1-Embodied,在物理扰动(如光照突变、遮挡)下仍能稳定完成任务,于具身评测平台 RoboColiseum 的 Robustness 子榜拿下第一。它不靠固定视角,而是多视角协同,并在训练中主动加入「不完美」数据,增强容错能力。

正文摘录

![](https://image.jiqizhixin.com/uploads/article/coverimage/f510f837-0104-43a4-85ad-d8d9cdfe71ea/022(2).jpg) 世界模型正迎来关键转向。 从 Genie、Sora 到 WorldLabs,它们已经将视觉世界模型推向了一个高度。但表象之下,它们仍是统计意义上的视觉模拟器 —— 精通像素排列,却不懂物理规律和因果逻辑。 新的跃迁正在发生。近年来,具身世界模型的赛道陡然升温,备受全球 AI 大厂的关注。具身世界模型的本质是直接与物理世界的规则和约束对齐,将视频生成能力转化为动作控制能力。比如说,一个球被抛出去会如何下落,机器人手臂抬起杯子时液体是否会洒出,抓取生鸡蛋时需要施加多大的力。这种 “物理规律的本质抽象”,正是嫁接数字仿真与物理现实的关键桥梁。 全球 AI 大厂已先行入局。谷歌、英伟达、特斯拉相继加码,或押注仿真训练平台,或自研机器人基座模型,试图率先卡位这一技术高地。而在这场竞速中,中国玩家同样不甘示弱。 今日,智象未来(HiDream.ai)正式发布具身世界模型 HiDream-O1-Embodied。 秉承原生全模态的技术理念,模型强化机器人物理感知与动态预判能力,助力具身智能实现更高阶的物理交互。具身模型的发布,标志着智象逐步实现了打通图像、视频、3D、动作等模态,贯通理解 — 推演 — 执行全流程,构建统一世界模型基座的技术闭环。 模型发布同期,HiDream-O1-Embodied 首次参评具身智能模型评测平台 RoboColiseum,即在核心的 Robustness(扰动适应)子榜单中,以平均分 0.692 的成绩登顶榜首。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-09-07原文

相关内容