兔展智能联合北大发布UniWorld-View 登顶世界模型榜单
兔展智能开源UniWorld-View,实现从单图/视频理解并生成新视角,登顶李飞飞团队世界模型榜单。
世界模型让AI理解未拍摄场景,UniWorld-View可从单图或视频按指定机位生成新视角,并保持空间一致性,已登顶WorldScore榜单并开源。
正文摘录
.jpg) AI 生成图片、生成视频已经越来越常见。 真正困难的,不再是 "生成一段内容",而是让 AI 理解真实世界。 例如: - 给 AI 一张图片,它能不能推断出照片背后没有拍到的场景? - 给 AI 一段视频,它能不能按照指定机位,自然生成新的拍摄视角? 这些问题,正是世界模型希望解决的核心能力。近年来,世界模型也逐渐成为视觉 AI 领域的重要研究方向。  WorldScore 榜单 最近,兔展智能联合北京大学、鹏城实验室研发的 UniWorld-View 登顶李飞飞团队 WorldScore 世界模型榜单(训练数据来自北大系初创企业元空智能),并完成国产昇腾算力适配与代码、权重开源。 官方地址:https://github.com/PKU-YuanGroup/UniWorld-View UniWorld-View 尝试回答的,并不是 "如何让 AI 生成一张更漂亮的图片",而是另一个更难的问题: AI 如何理解没有被拍摄到的世界。 AI 如何 "看到" 没有拍到的世界? 很多人第一次看到 UniWorld-View,会觉得:它像是一个可以 "任意换机位" 的视频生成模型。