张大妈

千问图像编辑模型评测:对战Kontext表现如何?

源自抖音:天选打工人赵图图

02-11 15:57

阿里巴巴新发布的千问图像编辑模型备受关注。这篇首发评测通过与同类顶尖开源模型Kontext在7大核心能力上进行正面对比,用数百张实测图片客观揭示了其真实水准、优势与短板,为关注AI图像编辑的用户提供了极具价值的参考。

千问图像编辑模型评测:对战Kontext表现如何?智能速览

  • 模型功能覆盖全面,兼具语义与外观双重编辑能力。

  • 在IP编辑和视觉转换等部分场景中表现优于竞品。

  • 整体稳定性不足,部分场景效果波动明显甚至失败。

  • 在风格迁移、服装修改等任务上与Kontext差距显著。

  • 重点宣传的文字编辑能力未展现出压倒性优势。

千问图像编辑模型评测:对战Kontext表现如何?精华内容

为了深入了解千问Image-Edit的真实实力,评测者选取了7大核心场景,与开源领域的标杆Kontext模型进行了全方位的实测对比,结果差异明显。

动漫IP与视觉转换

在动漫IP编辑方面,两者表现不相上下。例如在服装替换任务中,千问与Kontext各有成功案例,千问对动漫细节的把控力略逊一筹。在视觉转换测试中,千问展现出优势,尤其是在室内设计正面视图、鱼缸正面视角等场景的生成效果优于Kontext。然而,模型的稳定性问题在此环节暴露无遗,当处理人物头发颜色修改或建筑物视角切换时,常出现风格错乱、细节丢失的问题,导致结果完全不可用,表现出明显的两极分化。

风格迁移与服装修改

在风格迁移和服装修改环节,Kontext的优势变得非常显著。无论是对于艺术风格的掌控,还是对画面细节的保持,Kontext都表现得更加出色,例如在保持鞋子细节和人物一致性方面。在服装修改测试中,Kontext的效果可以说是大幅度优于千问,无论是给小兔子穿上衣服,还是真实人物的换装,效果差距都非常明显。评测指出,除了动漫IP编辑外,千问在其他服装修改任务中均处于下风。

文字编辑与对象增删

作为官方重点宣传的能力,千问的文字编辑功能并未拉开与Kontext的差距。英文修改能力两者不相上下,中文修改则均有待提高。千问能进行文字替换但识别目标不够精准,而Kontext能较好识别目标但替换效果不佳,最终结果都差强人意。在新增、消除与重绘测试中,两者对室内设计的处理都还不错,但在涉及人物编辑和海报设计的复杂任务上,Kontext的处理效果要远好于千问。

综合来看,千问Image-Edit作为一款开源新生代模型,展现了功能全面的潜力与特色,尤其在特定场景表现亮眼。但其稳定性、画面整体把控力及复杂场景处理能力与顶尖模型仍有差距。未来若能针对性地优化短板,它有望成为真正的图像编辑神器。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章