行业新闻

美图影像研究院提出 MiVE 与 CFT,实现可控视频编辑与精准重打光

美图把视频编辑和重打光的研究做成了用户可直接使用的功能,让改视频、调光线像点按钮一样简单。

美图影像研究院的 11 篇顶会论文聚焦真实创作痛点,其中 MiVE 框架能用一帧的编辑指令同步改变整个视频,CFT 方案则让照片重打光不再扭曲人物身份。这些技术已落地到美图秀秀、Wink、Picchi 等产品中,让普通用户无需复杂提示词即可完成专业级编辑。

正文摘录

![](https://image.jiqizhixin.com/uploads/article/coverimage/694a9842-2e4a-4a63-84f5-4628fd894f29/037.jpg) 过去两年,AI 生成图片、视频的能力不断刷新人们的认知。 今天,生成一张图片、一段视频已经变得很容易。 但真正困难的,是另一件事:让 AI 理解并按照创作者的真实意图完成创作。 比如: - 修改一行文字,同时保留字体、排版和视觉风格。 - 消除图片和视频中的冗余元素,但不能看出破绽。 - 自由变换发型、服饰、光线、场景,但要保持人物一致性。 - 修改视频中的局部内容、调整光影效果,不要影响整体连续性。 - 让模特试穿试戴,同时准确保留材质、纹理和光泽。 Prompt 的后半句,几乎都是为了规避模型误差而添加的限制。「保持一致」「避免失真」「不要改变」…… 这一长串提示词,是 AI 创作流程中的「惯用套路」。但理想状态下,我们对 AI 的期望是需求能被理解并直接执行,而不是先学习如何正确使用提示词。 AI 在视觉创作能力上的进化,本质上是视觉理解、空间建模、时序一致性、美学表达等多个方向的持续突破。这很难靠一次模型升级实现,而是需要围绕视觉技术长期积累。 过去几年,作为 AI 影像领域的「长期玩家」,美图影像研究院(MT Lab)一直围绕高频创作场景的真实痛点展开研究。2026 年以来,美图影像研究院(MT Lab)共有 11 篇论文被 ICLR、CVPR、ICML、ECCV、ACM MM 等国际顶会接收,覆盖视频编辑、人像编辑、智能交互、视觉理解等多个方向。 更重要的是,这些研究成果正不断通过产品落地,转化为服务真实创作场景的 AI 影像能力。 让 AI 实现更强大的编辑 在专业创作中,生成其实只是起点。人们往往需要经过多次尝试和调整,才能不断接近「理想效果」。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-08-12原文

相关内容