OpenAI 发布 ChatGPT Images 2.5,强化多轮改图与编辑稳定性
OpenAI 更新生图模型 ChatGPT Images 2.5,重点不在分辨率和视觉冲击,而是把多轮编辑和定点修改做稳,让生图真正接进生产流程。
OpenAI 上线 ChatGPT Images 2.5 生图模型,最高分辨率仍为 3840px,但新增 xhigh 和 max 两个质量档位,提升细节、材质与光照表现。用户可用草图作为视觉参考生成图片,框选局部即可定点修改,多轮对话中也能稳定保留已确认的内容与画质。
正文摘录
刚刚,OpenAI 发布新一代生图模型 ChatGPT Images 2.5,主打生成更快、细节更好,改图也终于越来越像“真·修图”了。 只要用鼠标(或者随便什么)画一张草图,再补充你想要的风格和细节,GPT 就会把它作为视觉参考,生成完整图片。 By the way,现在 GPT 终于支持看百分比的生成进度了,不用再问“在吗”看网断没断了! 如果说上面这些是功能层面的变化,那么从这次技术博客来看,相比 4 个半月前发布的 GPT Image 2,Images 2.5 真正值得看的升级,还是 生成质量和编辑稳定性本身。 Images 2.5 并没有单纯继续往上堆输出分辨率,最高依然是 3840px,但新增了 xhigh 和 max 质量档位,进一步提升细节、材质纹理、光照,以及参考主体的保真度。 给小孩哥换了一身衣服之后,脸部基本没怎么漂,尤其是原图里卷发那种稍微有点毛躁的质感,保留得相当完整。 而相比单纯“把图画得更漂亮”,Images 2.5 这次更重要的一个方向就是让修图改图变得更加可控。 虽然有些图看起来还是稍微有点“AI 塑料感”,但人物本身、场景关系和整体构图已经能比较稳定地保留下来。 不用再写一大段“请把画面左上角第二个人脸上的墨镜换成黑框眼镜”,直接圈那个地方,写一句要求就行。 很多时候,对于设计工作者来说,一张图不可能一遍生成就结束。第一轮把主体生成出来,第二轮改排版,第三轮换文字,第四轮再抠一些细节。 OpenAI 表示,在更长的对话中,Images 2.5 可以更稳定地接着上一轮结果继续修改,同时保住已经确认好的内容和画质。 比如下面这种旅行攻略海报,文字、照片、路线、排版全挤在一张图里,修改时需要同时照顾的元素比单主体图片多得多。 当然,除了编辑之外,Images 2.5 对复杂画面、材质和风格指令的理解也一起升级了。