行业新闻

A²-Edit 提出统一参考图编辑框架,支持任意类别与粗掩码

A²-Edit 解决了参考图编辑的两大痛点:跨类别泛化与掩码精度依赖,让用户用粗略区域也能实现高质量编辑。

上海交大与上海创智学院团队提出 A²-Edit,一个统一框架,能把任意类别物体自然融入其他照片,且不需要精细掩码。它通过混合 Transformer 专家路由和掩码退火训练,让用户仅用粗略区域就能完成身份一致、结构完整的编辑,在多个基准上超越现有方法。

正文摘录

![](https://image.jiqizhixin.com/uploads/article/coverimage/ca8fbc4c-d75a-4315-b8cf-90054d83b659/056(2).jpg) ![图片](https://mmbiz.qpic.cn/szmmbizpng/5L8bhP5dIqElqZ0GcgINP4V78xIEARSSDI7pRpUQpZAhGK6rr8zoMJM3icYLohdHNhq93gll1YkHwsYaOO3tolCuL5QN5gAtJc46PnNgECQI/640?wxfmt=png&from=appmsgimgIndex=0) 把参考图里的物体自然地「搬进」另一张照片,是电商商品合成、虚拟试穿、影视换脸与个性化创作的关键能力。真正落地却要跨过两道门槛:模型往往只擅长某一类物体,且高度依赖像素级精细掩码。 上海交通大学联合上海创智学院团队提出 A²-Edit,它以统一框架支持任意物体类别和任意精度掩码,通过混合 Transformer 专家路由、掩码退火训练及 50 万级多品类数据,让用户只需给出粗略区域,也能完成身份一致、结构完整、自然融合的参考图引导局部编辑。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-07-31原文

相关内容