商汤 SenseNova U1 Pro 正式上线,支持多轮图像编辑
商汤 SenseNova U1 Pro 上线,重点不是生成得好看,而是能反复按指令局部修改、不破坏其他细节,改到可交付。
商汤 SenseNova U1 Pro 图像模型正式版已上线商汤小浣熊平台,并向企业客户开放 API。实测显示,它能按指令只改局部(如换掉内搭 T 恤颜色)、融合多张参考图生成新场景,并连续多轮编辑而基本不动其他细节。
正文摘录
而且啊,这两张图片并非出自你以为的 Image 2.5 之手,实则是来自一个 国产 AI —— 正是我们之前称之为“今年 WAIC 最惊艳的图”背后的模型,来自商汤科技的 SenseNova U1 Pro(下文简称 U1 Pro)。 而这次是正式版上线,现在已经可以在商汤小浣熊平台上使用,API 也已经向企业客户开放了。 不过有一说一,图生成的好只是一方面;生成后能不能继续改、直到达到可商用,同样也是现在 AI 生图圈里比较关注的一点。 首先是 小浣熊 这个平台,点击输入框下方的 “一图读懂” ,就可以选择 U1 Pro 模型了: 不过目前小浣熊平台仅支持复杂图片的生成,企业客户可以通过 API 或者 SenseNova Studio 体验多轮修改等功能。 所以我们特意申请了实测邀请码,接下来的实测也将在 SenseNova Studio 平台上展开,同样是选择 U1 Pro 模型即可(2K 清晰度起步,最高 4K): 给生活照换个风格 第一轮实测,我们小试牛刀一下,拿一张随手拍的 生活照 ,把它重构成完全不同的风格。 可以看到,U1 Pro 很好地理解到了 Prompt 的意图,并在没有发生任何畸变的情况下,将整体图片变成了纸质的感觉。 但到这里还没有完,我们继续给 U1 Pro 上难度,让它在新图的基础上,只对局部进行调整: 只修改人物深色外套里面的黑色圆领 T 恤,将 T 恤改为白色。 修改范围严格限定在敞开外套之间、颈部下方至腰部上方可见的内搭 T 恤纸片,包括圆领边缘。 这张图局部改色的难点在于,T 恤是黑色的、皮带是黑色的、裤子也是黑色的,加上人物胸前还有胸牌遮挡,AI 极容易混淆边界。 但 U1 Pro 却精准地把 T 恤的边界给拿捏住了;由此可见,它对于图片整体的把控还是相当到位的。