写这篇之前先说清楚给谁看:不是给"抽卡玩家",是给靠图吃饭的人——电商运营、设计师、内容小编,那些已经在某个生图工具上花过钱、或者天天薅免费额度,这三天刷到"GPT Image 2.5"刷屏、纠结要不要换工具的人。
我把 9 月 8 日发布以来知乎、B站、小红书上能检索到的 40 多条实测内容过了一遍,再对着官方发布口径逐条核。先给结论:这次真正值钱的升级不是"画得更好看",而是"改得越多越不崩"——它动的是工作流,不是审美。 你该不该换,取决于你的活儿里"改图轮数"有多少。
一、先把官方口径摆出来:双模型、不加价、砍一半延迟
9 月 8 日凌晨,OpenAI 没开发布会,直接把 ChatGPT Images 2.5 推上了桌面端、移动端、网页端全量,免费用户也能用,不用申请。 API 侧同一次上了两个模型:知乎
gpt-image-2.5-flare:主打快,官方把它列为多数场景的默认选择,延迟比 GPT Image 2 最高低 50%。知乎
gpt-image-2.5-sunburst:主打精,花更多生成时间换更细的编辑控制,适合反复打磨的视觉工作流。小红书
两个模型都新增了 xhigh 和 max 质量档,token 价格沿用 GPT Image 2,没有涨。 官方还给了一个规模数据:现在每周通过 ChatGPT 和 API 生成的图片超过 30 亿张——这也是为什么这版更新全往"批量干活"上砸,而不是往"样图惊艳"上卷。知乎知乎

另外两个容易被评测标题淹没的功能点:ChatGPT 里新增 Sketch(对话框里画个草图、补一句风格描述就出完整图,随手画个构图就能用);生成时会显示进度百分比,等图的骨架屏里甚至内置了贪吃蛇——网友调侃"产品经理产能过剩"。知乎
二、全网实测:哪些是铁共识,哪些吵翻了
多条独立实测互相印证的(可以当事实用):
"指哪改哪"确实立住了。 过去 AI 改图的老毛病是让改 A、B/C/D 全跟着漂:换个背景商品变样,换句文案人脸跑了。2.5 的改进正是这里——多位博主实测换文案保人脸、改背景不动主体,B站甚至有博主标题直接写"连改 5 轮终于不崩了"。 官方 Precision editing 文档的表述是"只编辑用户要求的内容,保留其余细节"。哔哩哔哩知乎
多轮修改能累积。 先换标题、再换背景、最后调版式,后面的修改建立在前面的结果上,而不是每轮重新抽卡。这是从"一次性灵感"变成"可以继续加工的资产图"的关键。知乎
中文渲染和复杂逻辑场景稳了。 中文文字出图照旧是亮点;有博主用"橘猫坐办公椅拿 iPad、iPad 里还是这只猫拿这个 iPad"的递归嵌套图测试,层级理顺了没糊。 毛绒可乐罐、三国连环画这类材质/风格题,多篇实测给的都是正评。知乎

吵翻的(先别当真):
噪点:小红书有人说"之前的噪点没了",也有实测说"噪点问题依旧是灾难级别"——同一件事两个极端结论。小红书知乎
画质到底是不是碾压 2.0:B站有"13 组实测差距"、"全面碾压"的正方,也有小红书博主"对比下来感觉回到了最早 GPT image 水平"的反方。哔哩哔哩小红书
小字和细节:知乎"角落实验室"放大检查后发现,白板上的小字仍有明显 AI 味,网友还翻出官方展示案例本身就有细节瑕疵。知乎

注意一个方法问题:这些全是单人单轮的非双盲 UGC 实测,同一个模型、不同 prompt 就两个结果。共识只出现在"改图一致性"上,分歧全出现在"画质"上——这本身就说明问题:2.5 的增量在工作流侧,画质只是小修。
三、三笔账:免费额度、API 成本、聚合平台话术
第一笔,免费档够不够。 ChatGPT 全量(含免费版)直接能用 Images 2.5,打字生图、传参考图改图零门槛,已全量开放、不用申请。 对低频出图的人,先把手头的免费额度用满再谈任何订阅——这是这三天最不该错过的一条信息。小红书
第二笔,API 的真实成本。 token 价格和 GPT Image 2 持平,但新增了 xhigh/max 档——单价没涨,但档位越贵、单张消耗越多,"没涨价"和"变便宜了"是两回事,B站部分"比 2.0 还便宜"的说法不严谨:那是拿 2.5 的低档对比 2.0 的高档。 批量跑图前先固定尺寸、质量档各测一遍,算单张成本,别看发布稿。哔哩哔哩
第三笔,聚合平台的"0.04 元一张"。 朋友圈和知乎流传的"4 分钱一张、免费试用"是第三方画布工具的推广话术,不是 OpenAI 官方定价。 它本身不一定是坑——小样免费试没问题——但拿它和官方 API 直接比价没意义,计费口径、用的哪个模型、哪个质量档都可能不一样。看到低于官方成本的报价,先问"哪来的差价"。知乎
四、谁该立刻动,谁可以再看两周
批量出候选图、聊天配图、快速原型:Flare 就是给你准备的,官方默认推荐,延迟砍半先省的是你的等待时间。小红书
商品主图、活动海报、需要甲方来回改的成品:Sunburst + 网页端画布。"只改该改的地方"直接砍的是废片率和返工轮数——模型能把修改范围收住,图片才有机会从一次性灵感变成可以继续加工的资产图,这是这篇里最值得为它换工作流的一笔。知乎
游戏/UI 素材(精灵表、分镜、透明底):小红书已有实测把 2.5 直接拿去做战斗动作精灵表,透明背景和角色一致性比 Image 2 可用性强一档,可以先试。小红书
纯审美向创作:可以不动。这次评测到 Midjourney 8.2 的博主结论是各守山头;"画得像"已经不是 2.5 的主场。知乎

两个入口提醒:手机端和电脑端的编辑能力不同步——"圈一块只改一块"目前只有桌面网页端最完整,精细改图先用网页;最新编辑功能别拿 App 内测体验当产品缺陷去骂。小红书
五、接着盯什么
噪点和小字问题的后续版本修复——这是目前反例最集中的应用场景;
移动端圈选编辑的全量时间;
xhigh/max 档的计费明细是否公开到单张口径;
聚合平台低价套餐的实际出图质量与官方 API 是否一致。
一句话收束:GPT Image 2.5 不是图像模型的"画质军备竞赛"新一回合,而是图片模型第一次认真往"生产工具"走——它赌的不是你抽到神图,而是你不用重新抽。 对靠图吃饭的人,赌注押对了地方;要不要上桌,按你一天改几轮图来算。