这周 AI 作图圈相当热闹:8 月 7 日,xAI 正式发布 Grok Imagine Image 2.0,上线之后直接冲到了 Arena 文生图第二、单图编辑第二,仅次于 GPT Image 2。知乎 8 月 9 日,Arena 匿名盲测里又冒出一个代号 mona-lisa-1 的神秘模型,有测试者把它的生成图扔进 OpenAI 官方验证工具,直接扫出了源自 OpenAI 的 SynthID 水印,社区基本认定这就是 OpenAI 的新一代生图模型。新智元 而四月才发布、一路统治榜单的 GPT Image 2,王座第一次真正晃动了。

先看票数,再看排名
Arena 的排名不是厂商自卖自夸的样片秀,而是靠用户盲测两张图投票算出来的人类偏好分,比官方宣传更接近真实手感。但快照里有个被很多二次传播忽略的细节:截至 8 月 10 日,GPT Image 2 在 Arena 文生图榜上以 1380 分排名第一,在单图编辑榜同样排名第一。知乎 而 Grok 这边的成绩是:截至当前快照,文生图:GPT Image 2 为 1380±5、69194 票;Grok Image 2.0 为 1320±12、2722 票。单图编辑:GPT Image 2 为 1463±4、184189 票;Grok 为 1439±8、5931 票。知乎 Grok 的票数只有 GPT 的约 1/25 和 1/31,排名还处于 Preliminary 状态、置信区间更宽,把它理解成"强烈的第一梯队信号"比"稳坐世界第二"更准确。真正值得注意的是编辑榜:两者只差 24 分,说明 Grok 把最有生产价值的那块能力已经拉得很近。
别只盯排名,看分工
这周社区里被问得最多的问题是"大家现在都用什么AI生图?求个不踩坑的",典型描述是试了两个,一个排队太久、一个出图 AI 感太重,想找适合做封面、商品图和日常配图的。小红书 答案其实不在榜单上,而在各模型的分工里。
GPT Image 2:带字的图优先选它。 菜单、按钮文案、中日韩标题、多行说明,GPT Image 2 的可用率整体更高,返工更少,版式约束也更愿意照做。知乎 海报、信息图、UI 这类复杂排版也是它的主场。需要留意的社区反馈有两个:默认输出文件偏大,以及生成人像时偶发鳞片状纹理,重要成图记得放大检查。
Nano Banana 系列:电商的两匹役马。 本周有博主用同一组商品图对三个模型做了横评:Nano Banana Pro 的保真度最好,好到让人怀疑它是不是把原图直接输出来了,但一张三毛钱,成本是 Nano Banana 2 和 GPT Image 2 的三倍。知乎 商品不能变形、必须保结构款式的场景上 Pro,日常配图和详情页走量用 Nano Banana 2,画面更规整,性价比高得多。
Grok Imagine Image 2.0:最懂"改图"的那个。 它新增或强化了 Magic Wand 局部改图、Segmentation 精确选区、透明背景移除、最多 5 张参考图输入、9 种比例智能扩图,以及一批产品图、头像、电商、海报和游戏素材模板。知乎 换衣不换脸、一张主视觉扩出九个比例,这种最费人工的活儿它是对着做的。另有博主做过一轮 GPT Image 2 对 Nano Banana 2 的十回合对决,分工几乎是互补的:文字渲染、角色一致性、品牌资产偏向 GPT,速度与成本、写实感、事实准确性偏向 Nano Banana 2——与其争论谁是第一,不如先想清楚自己主要出哪种活。

换模型的两个坑:成本与渠道
生图真正的开销不是单价,是反复重抽。微博上有用户吐槽在即梦烧掉几百积分、亏了几十块,改了二百多张才勉强出一张半满意的。换模型前别急着充套餐,先用自己最常拍的题材跑十几二十张对比,心里有数再决定。另一个坑是渠道:多个推荐帖的评论区已经被第三方 API 渠道和聚合工具推广刷屏,还有一篇"无限次生图、免费薅用到爽"的帖子,评论上千条几乎都在"求分享",作者统一回复"私信"——典型的引流漏斗,免费额度背后是账号和隐私成本。小红书 相对稳妥的路径有三条:去 Arena 匿名盲测里免费试新模型;走各家官方入口,规则透明;做 API 接入则要看成熟度:GPT Image 2 四月就已开放 API,Grok 这边官方口径仍是 coming soon,差距明显。知乎
三个值得盯的信号
一是 Grok 的排名能否站稳:票数涨上来之后置信区间是否收窄、中文密集文字的成功率能否保持、多轮编辑后细节是否留得住,三项都成立的话,它对 GPT Image 2 的威胁就远不止"又一个榜单第二",因为它竞争的不是单张图片的审美,而是整条创意生产流程——不过现在的 Grok Image 2.0 已经值得和 GPT Image 2 并列测试,但还不值得因为一个刚出现的 #2 排名就全面迁移。知乎 二是 mona-lisa-1 的官方身份:社区连做五个日期类测试,模型的回答无一例外都停留在 2025 年,它更像同代地基上的一个新检查点,而不是换代大脑;但它的真实感提升明显、塑料感减弱,追求摄影级质感的用户可以等它转正。新智元 三是 Grok 的 API 什么时候开放,那是"个人能玩"和"企业能接"的分水岭,也是价格战真正开始的地方。

收个尾:带字海报和信息图继续跟 GPT Image 2;电商商品图按保真要求在 Nano Banana Pro 和 2 之间二选一;重度局部改图、多比例扩图去试 Grok;追求极致真实感的,等 mona-lisa-1 官宣。排名是厂商的战场,我们只算自己手里那张图的成本。你手上现在用哪个生图模型,最头疼的是什么?评论区聊聊。