光轮智能开源10万小时人类行为数据集,Hugging Face联合发布
开源10万小时人类行为数据,为具身智能提供训练资源,是物理AI数据稀缺时代的关键动作。
光轮智能宣布开源10万小时人类第一视角行为数据,覆盖家居、工业等场景,带手部、身体、语义三层标注。这是目前全球最大的开源第一人称数据集,供学术和商业使用,为机器人训练提供了关键素材。
正文摘录
全球首个!10 万小时人类数据全开源,Hugging Face 罕见站台 新智元报道  上周,一家名叫 Dyna Robotics 的公司干了件让整个行业集体失眠的事。 他们训练了一个叫做 DYNA-2 的模型。独特之处在于,预训练阶段一条机器人动作数据都没喂。 取而代之的是,他们给模型灌进了超过 100 万个小时的人类第一视角视频。相当于一个人连续学习 170 年。 结果,从 1000 小时一路到 100 万小时,每翻 10 倍机器人都在变聪明。更准确地说,是一条持续上升、没有明显撞墙的幂律趋势。 可以说,物理 AI 终于有自己的 Scaling Law! 消息一出,行业炸了。因为这等于宣告:训练机器人最稀缺的资源,不是 GPU、不是算法,而是高质量的人类行为视频数据。 谁手里有这批数据,谁就掌握了物理 AI 时代的石油。 但问题随之而来。这条曲线都看得见,但跑到关键拐点需要的那批数据,却都锁在各家公司自己的硬盘里。 直到这家公司把锁撬开了。 8 月 20 日上午,在 2026 世界机器人大会(WRC 2026)上,光轮智能宣布:10 万小时全模态人类行为数据,全部开源! 数据集叫 EgoSuite-Open100K,与 Hugging Face 联合发布,首批已上线 Hugging Face Hub 和 AtomGit。学术研究能用,商业训练也能用。