最近AI短剧圈在传一个让人五味杂陈的翻车现场:有团队熬了大半个月做24集霸总爽剧,上线第3天就翻车,第5集的男主从浓眉大眼的混血感帅哥,突然变成单眼皮小眼睛的路人脸,评论区当场炸锅,一夜掉了2.8万粉,前期投的1万多流量费全打了水漂。知乎先说明:这个故事出自一篇疑似软文(原文在推广某具体平台),数字无法交叉核实,但它描述的情境是真的——角色一致性不是"画面差点意思"的小事,它直接决定观众出不出戏、投的钱打不打水漂。
做过AI视频的人都懂这个痛:单个镜头生成得挺好,一连起来主角就变脸、变衣服、变身高。我花了几天把知乎、小红书、B站上在讨论的解法翻了一遍,去掉软文和噪音,整理成一张地图:锁定前、约束中、修正后三条线,外加一张选型表和一份避坑清单。
为什么一换镜头就崩
社区对原因的认识大致分两派。
一派给"参考图流"泼冷水。小红书上一篇热度很高的帖子说得很直接:很多人的习惯做法是先用AI生一张人物图,再拿这张图当参考去生视频,但在视频生成里参考图并不是参考人物,它只是一个风格与结构的弱约束。小红书作者本人关联AI工具产品,说法带立场,但他点破的新手误区确实最常见。
另一派则相信"资产化锁定":把角色做成卡、绑进分镜,让每个镜头调用同一份资产。现在流传度高的教程基本都在这条线上,下面三类方法都是它的变体。
锁定前:先把角色定死,再开机
1)角色卡:越详细越稳。 小红书作者安歌专门烧了一千多积分实测角色卡粒度对细节一致性的影响,结论是角色卡越详细,人物细节一致性越强。小红书她还把《丧尸清道夫》作者Mx-Shell开源的画布设计思路,整理成可复用到各类短剧资产里的角色设计流程。
2)分镜槽位绑定:把角色卡绑到分镜上。 不想每个镜头重复输入一遍外貌描述,更工业化的做法是生成前把角色参考图上传、绑定到分镜槽位,之后每个镜头自动调用。现在流行的画布类、工作流类工具基本都在往这个方向做,从拆剧本环节就把角色资产和分镜节点绑在一起。

3)站位法:先摆位置,再谈生成。 讨论度最高的是安歌的"AI导演台":先用3D人偶把人物站位摆好,配多视角场景图,再交给视频生成,一次解决多人物站位和多景别切换两个一致性难题。作者说这套方案是花了几千积分、烧出几十条失败案例之后才沉淀下来的。小红书

约束中:生成时让模型"看得见"角色
资产锁好了,生成时还得把"哪张图是角色、哪张图是场景、各自负责什么"说清楚。一位做了5组对照测试的创作者总结出结构化提示词模板,核心是两块:“素材分工”——让AI明确每张参考图的职责,避免信息冲突;“排除项”——提前屏蔽常见翻车点。知乎他的经验有点反直觉:提示词越结构化、越明确,首抽可用率越高,反而更省积分。

另一招是动作参考:想复刻某段视频的动作或运镜,又不想要原片的人物和画面时,把动作交给参考视频,让模型照着动,能大幅减少动作跑偏带来的重抽。
Seedance 2.5把"约束"的规格又抬高了一截:能原生生成30秒,能一次参考30张图片、10段视频和10段音频,还支持时间戳级编辑。知乎但体验文也提醒,这一代指令遵循极强,你给得含糊它就做得木,提示词得往分镜脚本的方向写。
修正后:给重抽和修补留预算
先接受一个现实:能用的镜头是重抽出来的。一位算账博主(本人经营AI视频平台,文内已声明利益相关)给出公式:一条成品的成本 = 单次生成成本 × 重跑次数,而改提示词、换种子、调时长、调镜头运动,3到10次重跑是常态。知乎所以"省积分"的本质不是少生成,而是少返工——前面锁定前和约束中的功夫,本身就是最省钱的策略。
成片局部有瑕疵,不必整条重抽:视频编辑能力今年明显变强。MiniMax在7月底发布的H3,在Artificial Analysis盲测榜单的视频编辑(含音频)项排名全球第一,Elo评分约1130,基于5043个盲测样本,也是开源模型首次在视频编辑类别超越所有闭源竞品。知乎Seedance 2.5本身也支持时间戳级编辑,哪个片段变脸,可以先试试局部修。
选型:看体量,别看榜单
模型之间的差距,看同场景实测样片比看参数直观。下面是同一哭戏方向下,Seedance 2.0、Seedance 2.5、MiniMax H3三个模型各自的输出样片。

按体量选:
你的体量 | 钱花在哪 | 理由 |
|---|---|---|
单条试水、打草稿 | Seedance 2.0 / 2.0 Fast | 便宜、快,废了不心疼,定稿再上2.5 |
多分镜短剧、30秒长镜头 | Seedance 2.5 | 原生30秒、最多30张参考图,提示词写得越像分镜越稳 |
低预算、修片、本地部署 | MiniMax H3 | 已开源,视频编辑全球第一,价格约为Seedance同规格四分之一 |
价格差值得单独看一眼:在Hailuo AI官方平台上,2K 15秒视频仅需180积分,而Seedance同规格需750积分,成本差距约4倍。知乎但有两个代价要知道:H3的图生视频输给Seedance 2.0,本地部署门槛也不低,ComfyUI深度优化后RTX 5090 32GB跑INT8版本接近满载。
更成熟的打法是组合用:试错阶段用2.0或2.0 Fast,定下来了再用2.5出终版,同样预算能多跑几倍次数。知乎2.5的价值恰恰在终版环节,它的指令遵循被体验者形容为:当一个模型100%听用户诉求的时候,这个模型本身的能力上限,就变成了用户的上限。知乎
避坑:这个选题软文含量高,还有两条红线
方法讲完,还得讲一句扫尾的:角色一致性的"横评文"里,软文浓度很高。这次采集我至少碰到三篇:一篇打着LibTV、即梦、可灵对比的旗号,通篇只夸LibTV的画布资产卡。知乎一篇推广句点AI的角色库,顺手给出"20集一致性100%、7天播放破120万"这种精确到反常的数据。知乎还有一篇省积分攻略,落脚点是引导去站外平台。共性三条:全文只夸一个产品、点名道姓用官方话术、结尾带引流链接或优惠信息。方法部分可以参考,数据和结论请自动打折。
合规红线一:别用AI编"真事"。公安机关"净网—2026"专项行动公布14起典型案例,其中多起是用AI工具生成车祸等虚假视频编造谣言,当事人已被行政处罚或刑事强制措施。微博
合规红线二:别碰真人。即梦已经对真人主体参考限权,平台明确提示目前暂不支持输入真人图片或视频作为主体参考。知乎这次限权来得非常快:从2月7日内测上线到2月9日紧急限权,前后仅两天。对创作者来说,这其实划出了安全区:角色卡尽量从虚构角色做起,他人人脸不能拿来做主体参考,用自己的脸也要完成实名和活体校验。
角色一致性,本质是把"抽卡"变成"工程":生成前锁资产,生成中给足约束,生成后留足重抽和修补的预算。这三条线,比任何咒语都管用。你卡在哪一步,评论区聊聊。