利用大语言模型的叙事能力和AI绘画工具的图像生成力,可以高效构建故事分镜。这套工作流特别适合短剧、动漫等创作者,能快速将文字构想转化为视觉参考,解决从0到1的创作难题,极大提升前期构思效率。
智能速览
工作流的核心是Gemini负责逻辑,Midjourney负责出图。
需在Gemini中创建特定智能体以提升输出质量和连贯性。
生成的25宫格分镜是参考素材,需后期挑选和优化。
该方法对短剧创作者有实用价值,能快速验证视觉创意。
输出结果可能受账号类型影响,Pro账号效果更佳。
精华内容
这套工作流的巧妙之处在于,将大语言模型的逻辑推理与AI绘画的创造力相结合,实现了从文字故事到视觉分镜的快速转化,为视觉创作者提供了强大的辅助工具。
核心工具搭配
该工作流主要依赖Gemini和Midjourney。Gemini作为大语言模型,凭借其出色的逻辑和推理能力,负责将故事描述转化为结构化的分镜提示词。
相比其他大语言模型,Gemini在剧情的连贯性、动作的把握上表现更优。而生图环节则选择Midjourney,因为它在图像生成的质量和自由度上被广泛认可。
两者结合,实现了从文字逻辑到视觉画面的高效流转。
分镜生成步骤
首先,进入Gemini官网创建一个名为“短剧分镜大师”的智能体,并为其配置预设的身份和任务指令。
然后,上传一张参考图片,并输入详细的故事描述,例如“女人在竹林漫步,突然出现两个刺客袭击她”。为确保逻辑缜密,需开启“thinking”模式。
Gemini会生成一段JSON格式的提示词代码,复制该代码。最后,在Midjourney中开启新对话,粘贴代码并附加一句指令,即可启动分镜图的生成过程。
产出物与应用
需要明确的是,生成的25宫格图片并非可直接应用的成片,而是用于拓展思路的参考素材。
创作者可以从中挑选优秀的镜头,再结合其他AI生成的片段进行拼接,形成一个完整的叙事序列。对于画面中出现的瑕疵,如面部崩坏、分辨率不高等问题,可以通过重绘、换脸或高清修复等一系列后期操作进行优化。
这种拓展性的工作流赋予了创作者更高的灵活性和再创作空间。
实用价值与局限
对于短剧制作等需要快速进行视觉化呈现的项目,这套方法能显著提升前期构思效率,提供了一个可视化的创意起点。
但它也存在局限,例如生成的图片风格可能不稳定,画面细节有时会出错。此外,使用Midjourney的Pro功能通常能达到更好效果,免费版或普通账号可能会受到限制。
使用者需要具备一定的后期调整能力,才能将AI生成的原始素材转化为专业级别的视觉分镜。
掌握这套AI辅助分镜生成方法,能让创作者在项目初期更高效地进行视觉化探索。它不仅是提升效率的工具,更可能改变未来的创作流程。如何将AI生成的素材与原创思维更好融合,是值得持续探索的方向。