阿里千问开源 Qwen-Image-2.1,7B 参数支持生图与编辑一体化
Qwen-Image-2.1 只用了 7B 参数,就把生图、改图和透明素材生成统一到一条管线,开源且评测得分超过 GPT Image 1.5
AI 生图离能交稿总差几步:人物要抠图、素材要改字,而包装上的文字、瓶身形状又不能跟着变。阿里千问本周日开源 Qwen-Image-2.1,把文生图和图像编辑合进同一个模型,原生支持透明图生成、最多 10 张参考图输入,视觉生成部分只有 7B 参数
正文摘录
.jpg) 编辑|泽南 AI 写代码的能力经常能让开发者「双手离开键盘」,但对于设计师而言,AI 生成的图片距离能交稿总是差了好几步。 在图像设计的工作流中,人物需要抠图、素材需要改字、各种商品的摆放要时不时调整,但包装上的字、瓶身的形状不能跟着变。如果需求不停调整,还得继续修改局部,让整张图保持协调。 这些细节决定了 AI 生图能否进入真正的创作流程。对设计师、电商运营和内容创作者来说,如今图像模型的瓶颈,在于每一次提出的修改指令能否准确完成。 本周日,阿里千问 正式开源图片生成模型 Qwen-Image-2.1 ,以小模型的体量解决了大部分生产力难题:它实现了文生图与图像编辑一体化,原生支持透明图生成,最高可以接收 10 张参考图,还进一步强化了局部编辑、人像与商品保真。  它成为了千问图像系列当前最平衡、性价比最高的开源生图模型。公开评测结果显示,Qwen-Image-2.1 取得开源模型第一,得分甚至超过了 Nano Banana 2.0。要知道,这个模型的视觉生成部分参数量仅为 7B。 在 X 等平台上,已经有提前获得体验资格的用户放出了生成结果,大家一阵好评。