这周刷B站和抖音的人,大概率被同一类视频洗过屏:一张动漫名场面的黑白线稿,七八个AI同台上色,最后GPT的版本一出来,评论区最顶的一条是"你gpt叔叔跟真看过火影一样"。哔哩哔哩
这不是个别爆款。从8月6日到12日这七天里,"不同AI上色对比"系列像连续剧一样更新:宇智波斑两条(播放16万和12万)、带土7.4万、五条悟"无限制乱斗"9.2万、龙珠4万、你的名字5.5万,死神、一拳超人、佩恩接连跟上,单条视频21秒,同提示词、同线稿、几家模型并排出图。哔哩哔哩小红书那边则是另一种画风,"想你的第145个夜晚,数过了9514颗星星"这类AI上色漫画帖连着更新,收藏数比点赞还高,主角是个戴圆眼镜的黑发双辫女孩,作者把线稿版和AI上色版交替着发。小红书

但看热闹之余,评论区真正吵起来的是另一件事:为什么GPT几乎总能对上原作配色,而国产模型动不动就把盔甲染成原作里不存在的颜色?这背后差的不是画质,是一个很多人没意识到的机制问题。想自己动手给本命角色上色的人,先把这件事搞明白,能少走很多弯路。
本周乱斗战报:谁在C位,谁在挨喷
先把这周社区用脚投出来的票摆一遍。参与乱斗的模型基本固定在这几位:GPT(ChatGPT生图)、Gemini(评论区爱叫它"哈基米",3.1、3.6、Flash版本都上过场)、Grok、豆包、元宝、通义千问、即梦、可灵。
各家的社区口碑,评论区总结得一点不留情面。GPT是公认的第一梯队,而且断层:斑那条视频里点赞前两名是"你gpt叔叔跟真看过火影一样"和"GPT最起码把眼睛整对了",带土视频下更直接,“别的ai都是自己上色,Gpt是直接把答案搬过来了”。哔哩哔哩
Gemini属于"强但不稳":五条悟那条里有人发现"Gemini甚至给左下角虎杖上的色都是对的",连画面角落的配角都认出来了,但同一批人也吐槽3.6 Flash把角色的嘴画崩了。哔哩哔哩国产这边分化明显,豆包是被cue最多的,有人觉得"豆包其实生图也还好,至少眼睛基本都画对了",但更多人在记录它的翻车现场,“为什么豆包老喜欢加上一些东西”“右眼的刀疤给上没了”;元宝则喜提清一色的"夯爆了"评价。
要说明一句:这些都是社区基于单张对比图的直观评价,样本就是视频里那一两张图,不代表各家的综合生图实力。豆包在别的场景被夸不稀奇,Grok在不同视频里也有"怎么这么烂"和"还不错"两种待遇。乱斗视频的本质是娱乐节目,不是评测机构。
GPT为什么能"直接搬答案":三条路线的差距
这是整场乱斗里最值得琢磨的问题。评论区点赞最高的一串讨论,其实已经把答案摸到边了:“为啥GPT会先搜索原作到底是什么样子,而其他ai只会对着图片底色靠想上色”。哔哩哔哩
拆开看,AI给线稿上色大致有三条路线,这周乱斗里全现形了。
第一条,纯看图猜色。模型只把线稿当一张灰度图,根据明暗关系和训练里学到的"大概率配色"往上填。它不知道这是宇智波斑,只知道"这里有一副盔甲"。盔甲染成原作里不存在的颜色、凭空加装饰、把刀疤抹掉,基本都是这条路线的产物。大多数模型在遇到不认识的角色时,走的就是这条路。
第二条,认人,然后回忆原作。GPT被公认强在这里:它先通过多模态理解认出"这是带土、这是六眼状态",再从自己的知识里调出这个角色的官方配色,相当于开卷考试直接翻到了答案页。所以它能对上眼睛、对上盔甲,连求道玉这种细节道具都不丢。Gemini认角色的能力也被反复验证,只是执行环节偶尔掉链子。
第三条,背答案。有模型对某些热门角色的配色命中得过于精准,社区怀疑它压根是被热门番剧的彩色版本喂出来的,看到线稿直接输出记忆里的官色。斑那条视频里有条293赞的热评:“原画白色盔甲能上成红色,那么只有一种理由,上色版被炼化了”。哔哩哔哩这条路结果上看着最神,但换个冷门角色立刻打回原形。
需要说明的是,第二条和第三条是社区基于输出结果的推测,各家厂商并没有公开过具体的技术路径,看个逻辑就好,别当官方结论。但对使用者来说,结论是实用的:你要上色的角色越热门、设定越出圈,"认人流"模型的优势越大;角色越冷门、越原创,大家就都回到了同一条"看图猜"的起跑线,国产模型未必会输。比如有位小红书用户晒出自己手绘的线稿,门口站着一个光头小男孩和它的青梅竹马,这种纯原创角色,任何模型都无答案可背。

想自己动手试试?按目的选,别按名气选
看别人乱斗是娱乐,想给自己本命上色是另一回事。这周乱斗视频底下,问得最多的就是"关键词生图的话用什么好"。按你的实际目的来分:
就想玩一下、图一乐:豆包、元宝、通义千问的App都免费,直接丢线稿进去让它上色就行。豆包出片稳但爱自由发挥,前面那张线稿被豆包上色之后,光头的野菜小朋友变成了剪发头小妹妹,青梅竹马硬生生变成芙蓉并蒂。小红书出图后记得核对一遍细节;元宝这周口碑翻车,适合当对照组玩梗。

想认真出一张能对得上原作设定的图:优先选"认人能力强"的路线。ChatGPT免费版就能生图改图,但次数有限制,热门角色命中率高;Gemini免费版可用,认角色同样在线,出图质量波动需要多roll几次。如果你是Plus会员,这周的共识是GPT处理复杂场面和细节道具(眼睛、盔甲、专属道具)的完整度还是最高的。
想白嫖尝鲜最新的:竞技场网站arena.ai最近在免费内测,对战模式里刷到叫mona-lisa-1的模型就是GPT新一代生图模型。哔哩哔哩社区反馈比上一代干净不少,但内测窗口随时可能收紧,别把它当稳定工具。
想走专业路线、控制风格和细节:乱斗视频里也有较真的观众自己下场,用PixAI这类绘画向工具图生图,反馈是"调好久提示词和参数都失败了,最后无奈文生图"。哔哩哔哩专业工具上限高,但门槛和学习成本也高,不适合第一次上手的人。
三句劝退式提醒,上色前先看
第一,别商用,碰都别碰。这些乱斗视频无一例外标着"原图素材来源网络侵权必删"——线稿的版权归原作者,可能是漫画官方,也可能是某位同人画师。哔哩哔哩AI上色图自己玩玩可以,拿去接单、印无料、做周边,就是把两层版权风险叠在一起。
第二,发图前想想"鉴AI"这阵风还在刮。上周末刚有画师因疑似用AI塌房、也有手绘被误鉴成AI的争议,现在各个绘画社区对AI图的神经都很紧绷。把AI上色图发到绘画圈却不说清楚,很容易被当成另一种性质的"炼化"。标注"AI生成"不丢人,是这周的社区共识。
第三,对上色结果别太当真,尤其是冷门角色。本周所有"神级命中"都发生在斑、带土、五条悟这种顶流角色身上。一旦换成冷门番、原创角色,认人路线失效,全员回到看图猜色,翻车率会陡增——到时候别怪模型,是题目超纲了。
这场乱斗大概率还会继续更新,下一个被拉去上色的可能是某个新番名场面,也可能轮到国产模型在某一期里翻身。值得继续盯的信号有两个:一是GPT新一代生图模型内测什么时候放开、会不会把"认人上色"的门槛进一步拉低;二是即梦、可灵这些国产选手什么时候把角色识别这块补上——那才是它们真正翻盘的时刻。