昨天(8月21日)凌晨4点,OpenAI 悄悄上线了一个更新:GPT-Image-2 的 API 预览版,支持透明背景输出了。知乎
一句话可能看不出分量。但对所有"拿 AI 生成的图干活"的人来说,这可能是今年 AI 生图圈最实在的一次升级——比任何画质提升都实在。因为它解决的不是"画得好不好看",而是困扰了大家很久的"生成的图根本没法直接用"。
一、先说清楚:是真透明,不是棋盘格糊弄你
没被折磨过的人可能不理解这个痛点。你试过把 AI 生成的图当素材用——游戏立绘、电商产品图、做表情包——一定经历过这套流程:模型生成的图永远带背景,想要抠出来,得先在提示词里写一句"green screen background",让它生成纯绿底,再拖进 PS 里抠。角色立绘这种轮廓干净的还凑合,一旦碰到发光特效、半透明光晕、头发丝,绿幕方案直接崩:发光粒子的边缘本来就是半透明的,绿色渗进这些像素,用色彩范围选取,要么把光一起删掉,要么留一圈绿边,进引擎换个深色背景立刻现形。
问题出在哪?绿幕从头到尾就没记录过"这个像素应该是50%透明"这种信息,PS 只能靠猜,猜错是必然的。
这次不一样。GPT-Image-2 现在是生成时就直接输出带 Alpha 通道的 PNG——模型在画图的时候,就把"哪里该透明、透明多少"当成画面的一部分来算。API 侧的用法很简单,response_format 传 png,再加一个 background: transparent 参数,拿到的就是带 Alpha 通道的 PNG,不用再抠图。知乎发光边缘是渐变的半透明,发丝末端自然消散,生成完就是成品,中间不用再过一道抠图。
而且有开发者实测,网页版 ChatGPT 也能直接出真透明 PNG——拖进 PS 里验证过,是真透明,不是那种画了张棋盘格图案假装透明的"假 PNG"。知乎

二、谁最受益?帮你排个序
这次更新不是人人都有必要冲,受益程度分得很清楚。
第一梯队:游戏开发、UI/平面设计师。立绘、图标、技能特效这三类素材的管线直接跑通了,生成完就能拖进 Unity、Figma,没有中间步骤。知乎尤其是特效——以前发光类素材因为抠图问题基本没法用 AI 做,只能手绘或者用粒子编辑器硬拼,现在一句话出带透明的底图。有开发者说得直白:AI 开始能直接生产进得了游戏资源管线的素材,而不只是一张"好看的图片"。知乎

第二梯队:电商做产品图的。产品图本来就要抠图换背景换场景,现在省掉抠图这步,还能基于同一个产品主体一键换主题——已经有人拿它给同一只小猪生成了圣诞版。知乎批量出主图、场景图的效率账,自己算得过来。
第三梯队:表情包、贴纸、自媒体配图玩家。收益有,但没那么刚需——这类内容本来就是整张图直接用,少了抠图环节属于锦上添花。
三、怎么试,以及两个坑
想尝鲜的,两条路:走 API 的,记得现在是预览阶段,response_format 传 png、加 background: transparent 参数就行;不想折腾 API 的,可以先在 ChatGPT 网页版里直接要求"生成透明背景的 PNG",有用户实测免费版也能出。
两个坑提前说。一是预览阶段行为可能随时变,正式商用前别把核心工作流全押上去。二是别指望它完美——有人测序列帧,动作连贯性还有问题,复杂边缘偶尔还是会翻车,"多抽几次卡"仍然是基本操作。知乎
四、真正该盯的,是它背后那盘棋
把时间线拉长看,这件事就有意思了。今年4月发布的 GPT-Image-2,至今仍是当之无愧的 AI 生图之王。36氪但这个月的生图圈相当热闹:8月9日前后,一个叫 mona-lisa-1 的匿名模型悄悄出现在 LMArena 盲测榜,第一轮盲测下来,细节比 GPT Image 2 更丰富、背景伪影几乎消失、真实感更强。知乎

它的身份是怎么实锤的?有网友把它生成的图扔进 OpenAI 官方验证工具里一查,直接扫出了 SynthID 水印——这是 OpenAI 图像模型特有的数字签名。36氪
紧接着8月20日前后,第二个检查点 luna-lisa-alpha 又被测试者发现,社区测出来的升级点很集中:角色一致性大幅进步(这是 GPT Image 2 被吐槽最久的短板)、画面颗粒感减少、文字排版能力变强。知乎
同一时间,马斯克那边的 Grok ImagineImage 2.0 也没闲着:上传一张图自动拆图层、圈哪改哪,靠着这套精准编辑和改表情包玩法,在大模型竞技场文本转图像和图像编辑两个类别都打到了世界第二。36氪

注意到没有:上周小红书还有人在吐槽"为啥 GPT 生图总感觉脏脏的",升级之后画风辨识度是高了,但不少图灰蒙蒙、糊糊脏脏的。小红书这边 luna-lisa-alpha 的测试者就说颗粒感消失了。如果这些匿名模型真是 OpenAI 的下一代,那大家吐槽的脏感、塑料感、角色崩坏,可能都在下一版的射程内。不过话说回来,OpenAI 至今没认领 luna-lisa-alpha,它到底是 2.5、是 mini 版还是别的什么,现在都是社区猜测,别把网友实测当成官方承诺。
五、最后说点判断
我的感觉是:AI 生图的竞争,正在从"比谁画得好看"转向"比谁生成的图能直接用"。画质卷到现在,头部模型之间的差距普通人肉眼已经不太分得出来;真正卡脖子的,一直是"这张图能不能不改、不抠、不返工,直接进我的工作流"。透明背景、图层编辑、角色一致性,最近这些更新全都在补这一课。
所以,要不要换姿势,分情况:
做游戏素材、电商产品图的:这周就值得去试,省下的是每条素材的抠图时间;
做设计、排版的:可以试,但预览版先别进正式生产流程;
纯玩表情包的:看个热闹,等你手头的工具不香了再说;
所有人都值得做的:把手头 GPT Image 2 的提示词攒好,下一代模型来的时候,提示词资产可以直接带过去。
接下来值得盯的信号:luna-lisa-alpha 什么时候被官方认领、透明背景什么时候结束预览、以及国内这边即梦、豆包们多久跟进。AI 生图这张桌子,今年下半年只会越来越挤。