阿里开源社区发布了Qwen Image Edit 2511模型,作为目前开源社区可用的强大编辑模型,它在角色一致性和像素偏移问题上进行了重点优化。此次更新不仅带来了更稳定的画质,还配合LightX2V加速LoRA提升了生成效率,值得AI绘画爱好者关注。
智能速览
角色一致性相比2509版本有显著提升
像素偏移问题得到优化但未完全消除
推荐使用LightX2V加速LoRA以获得更好效果
模型画质进步明显,支持多视角与换装生成
显存占用较高,5090D实测需关注资源占用
精华内容
本次升级核心在于解决角色一致性和像素偏移痛点,通过实际案例测试,新模型在多视角合成与换装场景下的表现究竟如何?
角色一致性增强
实测显示,2511在多图合成任务中表现优异。例如将图一人物与图三玩偶结合并参考图二画风时,角色特征保持稳定,并未出现崩图现象。即便是三人合影或换装等复杂场景,服装细节与角色参考均处理到位,相比2509版本有实质性进步。
画质与加速建议
在画质方面,2511对比前代有明显提升。值得注意的是,在ComfyUI中直接运行原模型效果可能不佳,容易出现崩图,建议搭配LightX2V加速LoRA使用。测试表明,加入LoRA后,在保持高质量输出的同时,仅需4步即可快速生成,效果优于直接运行原模型的40步设置。
像素偏移与显存
官方重点优化的像素偏移问题确实有所缓解,但测试中发现并未完全根除,仅在边缘处仍可见轻微位移。此外,该模型对硬件资源要求较高,在5090D显卡上运行时显存占用显著,普通用户在本地部署时需留意显存容量,避免因资源不足导致报错。
Qwen Image Edit 2511的出现确实为开源图像编辑注入了强心剂,虽然仍有优化空间,但已具备很高的可用性。对于追求角色一致性与画质的创作者来说,这是一个值得尝试的新工具,期待后续社区能挖掘出更多玩法。
关键评论
其实像素偏移几乎被官方解决了,只要不连接VAE到提示词里面就行。
相比前代角色一致性变了,NSFW没了,光影效果更好了。
新模型体积变大导致显存和硬盘占用飙升,热度不及预期。
感谢阿里开源,这是目前开源社区能用到的更强大的编辑模型。