两天前,一条标题为"不懂就问,为啥GPT生图总感觉脏脏的😭"的帖子在小红书火了。小红书两天里2700多赞、2300多收藏,评论区一百多条"是我本人"。它描述的正是不少人8月以来用GPT生图的共同体验——升级之后画风辨识度巨高,但很多图总灰蒙蒙、糊糊脏脏,画面像蒙了一层说不清的雾,色块乱糟糟。
我一直在盯着AI生图这个圈子。这次把小红书的讨论、热帖评论区、知乎上刚发的8模型横评测试,以及最近一个月的新模型动态拼在一起,把这件事彻底理了一遍:"脏感"从哪来、怎么修、实在受不了该换谁。

一、先说结论:"脏感"不是你的错,模型自己就带
先给你吃个定心丸:这不是你提示词的问题,也不是会员等级的问题,而是GPT生图公认的特征。
今天刚在知乎发布的一篇海外图像生成横评译文中,作者把同一段提示词丢给8个模型——GPT Image 2、Nano Banana Pro、Midjourney v8.2、Ideogram 4.0、Flux 2 Pro、Krea 2、Reve 2.1、Higgsfield Soul 2——生成同一张肖像,结论和评论区对上了:GPT Image 2是这组里最"听话"的,对光线的理解最字面,皮肤质感最好,也不扭曲虹膜——这组里能做到这点的模型不到一半。但放大看,背景里有一种轻微的云雾状纹理,作者直接说这是"它一直被诟病的那个问题,那种细密的织纹会时不时冒出来"。知乎也就是说,你看到的"脏",和测试作者看到的"雾状织纹",是同一件事。社区里还有别的解释,比如"GPT生图会加隐形水印,所以色块看着脏",比如"模型问题,香蕉就没这个情况"。水印说目前没有权威证据,当一种声音听听就好;但"模型本身有这个倾向",是测试和评论区共同认账的。
那篇横评里有句话说得好:提示词不是一道命令,而是一段文字,任何文字都需要有人来读。每个模型在不同的语料里长大,把同一句话翻译成自己训练数据里理解的"美"——这就是模型的"口音"。它不是错误,也不是缺陷,而是训练数据的指纹。知乎同一句"治愈系小镇",Midjourney画出来是电影感插画笔触,换个模型可能是3D渲染质感。脏感,某种意义上就是GPT的口音。

二、"脏感"的另一半,是你自己改出来的
翻完评论区,我发现一个被高度认同的观察:第一张图通常不脏,脏感是在同一张图上反复改出来的。小红书很多人的工作流是:生成后不满意,在同一对话里连续让GPT"改这里、改那里"。多轮修改会让噪点和纹理一层层叠加,越改越脏。评论者给的改法很朴素:把图片下载到本地,新开一个对话,上传图片再让它改。
同帖最高赞评论(700多赞)直接给出了办法:在提示词里声明"干净"。小红书
“整体画面必须干净、平滑、统一,强调大色块叙事与整体轮廓,不要细碎噪点,不要高频纹理,不要脏污颗粒,不要密集小装饰,边缘清晰利落,表面干净,画面呼吸感强,一目了然。”
我交叉看了好几条帖子,用这类声明的人普遍反馈画面干净度明显改善。也有技术流玩家说,直接调API出2K图,画质会好很多——网页版的压缩和预览,本身就是"脏感"的放大器之一。
所以修复优先级很清楚:先加干净声明,再把改图方式换成新对话+上传图,有条件试试API。三招都救不回来,再考虑换模型。
三、要换,换谁?看"口音"成绩单
同一篇横评还给出了其他模型的"毛病",翻译成人话:
Nano Banana Pro:结构有序性和物理连贯性这组最好,最懂"画面里有什么",社区反馈也是"香蕉没噪点这个情况"。代价是皮肤雀斑分布很"算法化",整体不太读得出"照片感"。
Ideogram 4.0:最早以图里写字出名,新版反而靠超写实 standout——皮肤质感好、对焦准、不畸变虹膜;缺点是凑近看画面发"软",人物表情有点"神游"。做海报、文字场景,它仍是首选。
Reve 2.1:原生4K、构图规整,但太干净太"平均"——那种毫无瑕疵的平均感,恰恰是人眼一眼认成"AI"的东西。
Midjourney v8.2:测试里的审美标杆,要"艺术感""电影感"还是找它。
Flux 2 Pro:皮肤"瓷器感",更像写实油画而不是照片,这轮真实感排最后。
Krea 2:磨皮+叠加毛孔纹理,像仿制图章用过头,还有虹膜变形——注意避坑。
国产选项这个月也很活跃。7月下旬发布的Qwen-Image 3.0,中文文字渲染效果被实测称为"炸裂"。36氪B站这边,即梦和Seedance 2.5是本月视频生成的顶流,生图同样能打;想折腾本地开源的,盯住MiniMax H3——这个月B站的ComfyUI教程几乎都在讲它。
过去半年刷屏的玩法——把窗外随手拍变成3D微缩世界、长文一句话转成手绘板书图——几乎都出自Nano Banana,背后是同一种能力:它先理解画面内容,再动手画。

没有全能模型,只有"你今天需要哪种口音"。写实质感的人像,要GPT的听话加你的干净声明;场景推理和改图,用Nano Banana;文字海报,用Ideogram;艺术感,用Midjourney。
四、最后,几句值得存下来的话
"脏感"一半是模型口音,一半是叠加噪点;先修用法,再谈换模型。
干净声明提示词是成本最低的一招,先贴上去再说。
别在同一对话里反复改图,新对话+上传图。
8月的生图圈非常热闹。OpenAI新GPT Image 8月10日突袭,碾压Image 2,塑料感终于消失。36氪马斯克的新生图模型11日也放了出来。36氪Gemini则因为新增的被动生图特性,正常聊天就自动弹图,在微博被吐槽。微博Qwen-Image 3.0上线也才半个月。不着急的话,等这轮新模型的测评尘埃落定,再决定换不换主力,不迟。

潮玩、古风、微缩、板书这些把AI生图特点用足的玩法,大概率还会被这波新模型再把门槛压低一档。模型会继续迭代,"你今天需要哪种口音"这个问题,值得你一直问下去。