AI生成动漫短剧时,人物与场景不一致的“抽卡”问题曾让许多创作者头疼。一个基于Coze平台的工作流,通过一键生成9、16或25宫格的分镜图,从根本上解决了这一难题。它不仅能保证画面风格的统一,还极大提升了动漫、游戏、仙侠等多种题材短剧的制作效率。
智能速览
Coze工作流可生成9、16、25宫格分镜图,确保人物场景一致性。
该工作流通过视觉理解模型分析参考图,生成精准提示词。
生成分镜图后,可结合视频模型直接制作AI动漫短剧。
9宫格画面清晰,16宫格节奏适中,25宫格适合复杂转场。
工作流搭建涉及大模型配置、意图识别和插件调用。
精华内容
想要告别AI生成图像时反复“抽卡”的烦恼?这个Coze工作流能帮你一键生成多宫格分镜图,从源头解决人物和场景一致性的问题,让AI短剧创作变得更可控。
告别抽卡
AI绘图在生成连续性画面时,随机性导致的人物和场景不一致是最大痛点。这个工作流的核心价值在于,通过结构化流程生成多宫格分镜,确保了故事的连贯性。
它支持三种格式:9宫格画面较大,人物表情动作清晰,适合简单叙事;16宫格在画面节奏和信息密度上取得了平衡;25宫格画面细腻,分镜密集,非常适合打斗、悬疑等转场复杂的剧情。
创作者可以根据剧本需求,灵活选择最合适的宫格数量,为后续视频生成高质量的素材。
工作流搭建
搭建工作流的第一步是配置“开始”节点,定义输入变量。需要设置三个核心变量:首先是角色参考图,变量类型选择数组,支持上传多张人物图片,以确保故事中不同角色的一致性。
其次是剧本文本,变量类型为字符串,用于输入故事的详细文案。最后是分镜数量,变量类型设为整数,用于输入9、16或25,以决定最终输出的宫格格式。
核心逻辑
工作流的核心在于利用大模型进行“视觉理解”和“提示词生成”。这里选用豆包1.6模型,它能深度分析上传的角色参考图,并结合剧本内容,生成20-30个英文单词的精准提示词。
为确保稳定性,可配置豆包1.5作为备用模型,防止主模型因任务过重而超时。生成的提示词会经过一个“文本处理”节点,拼接一段保持风格一致性的指令,例如要求模型注意空间布局和美术风格,确保所有画面源自同一世界观。
图像生成
处理后的提示词将被送入图像生成插件,例如NAR图像生成。插件会接收文本处理节点输出的完整提示词和开始节点提供的参考图数组。
生成参数中,宽高比可设为16:9的横屏模式,以适应短剧播放。生成完成后,插件会输出一个包含所有分镜图URL的数组,这些画面在人物形象、服饰和场景风格上均保持了高度一致。
流程整合
为了让工作流能智能选择宫格数量,需要加入“意图识别”节点。该节点根据用户输入的数字(9、16或25),将流程路由到对应的分支。
为避免数据拥堵,在文本处理节点前需增加一个“变量聚合”节点,将各分支的提示词输出汇总,再统一进行处理。这样,无论用户选择哪种宫格格式,工作流都能准确无误地执行任务。
关键评论
多位网友希望获得该工作流的具体提示词和配置文件。
部分观众已通过教程学会搭建方法,并表示期待应用到实际创作中。