李飞飞创企发布世界模型 Atlas,支持原生相机控制与 3D 重建
李飞飞团队用三维空间锚定图像的方式训练世界模型,使 AI 生成的视频能精确控制镜头并重建场景,这是迈向空间智能的关键一步。
Atlas 是 World Labs 发布的全模态模型,能同时处理文本、图像、视频和 3D 数据。它的独特之处在于“空间上下文”:每张输入图都带有相机位姿(拍摄时相机的位置和角度),模型据此生成指定镜头的视频,并重建出 3D 场景。目前 Atlas 未开源,仅向部分合作伙伴开放。
正文摘录
.jpg) 编辑|Panda 今天,李飞飞创业公司 World Labs 发布了新一代世界模型 Atlas 。其中一个示例是它生成的画面:李飞飞在办公室里叠衣服,效果极为真实。[](https://mp.weixin.qq.com/s/IlL8LersKlXHXPuPIShbow) 李飞飞本人也开玩笑转发说:「我们办公室里确实真的在叠衣服!」  那么,Atlas 究竟是什么?又是如何让数字世界的李飞飞分身如此拟真地叠衣服的?