TryOnCrafter 实现自由视角视频虚拟试衣,支持环绕观察
这篇研究提出 TryOnCrafter,通过 4D 几何锚定让视频试衣不再绑定原始相机轨迹,用户可自由运镜查看穿搭效果,是可控相机虚拟试衣的首个统一框架。
视频虚拟试衣(VVT,将服装迁移到动态人物视频的技术)长期受限于固定镜头。TryOnCrafter 引入可渲染的 4D 试衣代理——用 3D 高斯泼溅(一种基于点云的渲染技术)构建的穿衣人体模型,让用户能自由旋转、拉近、环绕观察试衣效果,甚至实现子弹时间。
正文摘录
ECCV'26 | 为视频虚拟试衣解锁自由视角,TryOnCrafter 玩转 4D 试衣代理 .jpg)  视频虚拟试衣(Video Virtual Try-On, VVT)作为电商展示与数字内容创作中的核心技术,已在动态人物换装、服装纹理保持和视频时序连贯性方面取得显著进展。然而,现有方法大多仍受限于固定相机视角,生成结果被动依赖源视频的原始相机轨迹,难以满足用户对于自由旋转、拉近、拉远或环绕观察试衣效果的真实需求。 面对这一挑战,我们提出了首个面向可控相机视频虚拟试衣(Camera-Controllable Video Virtual Try-On, CaM-VVT)的视频 DiT 框架 TryOnCrafter。得益于显式 4D 几何锚定,TryOnCrafter 首次系统性解决了试衣场景中的用户自由运镜需求,支持主体重定位、子弹时间、360 度环绕等全新试衣效果,在保持人物结构稳定、服装纹理连续与场景关系自然的同时,真正让用户从「观看固定视角试衣视频」走向「自由探索动态穿搭效果」。