理科生 0 基础入门 AI 视频,LibTV + 满血 Seedance2
LibTV 前段时间上架了一个神秘的模型 —— StarVideo 2.0 模型。
好多人都说这个其实就是 Seedance 2.0,是最强短剧工作流平台 + 最强生视频模型的组合。
没错,的确就是。
当时刚好在外面旅游,没能第一时间体验上。
最近,我好好体验了一下。
使用下来后,给我的感觉就是舒畅。
我一个理科生。
没有任何的编剧、导演背景,也没有很强大的审美。
不懂艺术审美的这些所谓的镜头感、画面感、镜头语言。
竟然也可以利用 LibTV 制作一个看起来还不错的动画短篇。
下面,我会从一个啥也不懂的理科生入手,一点点剥开 AI 短剧的神秘面纱。

一、强模型,高效率,是做视频的重中之重
以前我尝试过做 AI 视频,各个平台都试过。
但是挫败感特别强。
原因无它,就是做出来的东西感觉就是一坨。
要镜头感没镜头感、要一致性没一致性,就是一些东西生拼硬凑在了一起。
那个时候的视频模型其实很差,需要通过专业知识去弥补,得知道镜头怎么运动、动静怎么结合、画面怎么分布。
Seedance 2.0 的首次发布,国内外夸奖铺天盖地,让我第一次意识到了,是不是非专业人员,也有能力做一个好视频。
我想尝试,但是没成功。
首发的 Seedance2 只能黑金会员使用,而且一个视频排队几个小时都是常态。

但在 LibTV 里,我却体验到了快速生视频的快乐。
制作视频基本上不用等待的。
每个模型后面都有一个等待时间,像LibTV Seedance 2.0 这样的最强模型,显示 2 min 的生视频时间就是极限。
速度快了,效率就高了。
不管是从图到视频,还是从文字到视频,多个并发任务同时进行的时候,我甚至还赶不上大模型生视频的速度。

Seedance 2.0 的视频能力,是毋庸置疑的。
它对剧本的理解不是一个简单的镜头。
我在一个 5 秒的视频中,只是几句提示词,Seedance 2.0 就可以进行连贯的理解。
通过对剧情的理解,把控整体的视频节奏,然后利用多镜头转场提升画面过渡效果,舒适能力大大提升。
相当于,我们只需要高速 Agent,我需要一个怎么样的画面,它把导演的工作直接做掉了。
多镜头转场,是我认为提高视频效果的一个很重要的部分。
好的转场,可以更自然的衔接画面的变化,推进剧情的发展,也是我认为对 AI 视频观赏度影响最大的一部分。
在 LibTV 中,除了文生视频、图生视频、首尾帧等等传统方案。
还有一个独立的全能参考,也可以说是万能参考。

我只需要引用一段视频,一张图片,然后搭配 Seedance 2.0 对剧情的理解。
几句大白话就可以搞定这个辨识度极高的转场画面。
二、从文本到剧本,从剧本到分镜,包圆了
之前我介绍过短剧工作流。
它们整合了从文本到分镜到生视频的一些流程。
工作流是好的,但是有个小问题,就是生硬。
流程是固定死的,不能变,只能一步步往下走。
但是做视频这件事,本身就是一件特别需要灵活的工作。
创作力和想象力随时随地都会迸发出来。
想到一个奇妙的点子了,这个时候再让我返回上个流程去,就很痛苦。
这一点,LibTV 做得很好。它提供了一个无限的制作画布。
在画布上,我们可以放文本、可以放图片、可以放视频,任何东西都放在一起,而且互相之间可以互相引用。

网状的素材引用结构,看起来乱,用起来却很省心。
新建一个文本节点,在里面写入大致的视频剧情。
新建若干个图片节点,在里面生成剧情人物,保持一致性。

两者一连接,一个包含了人物、场景、剧情、动画效果、镜头语言等等等等在内的分镜剧本就自动生成了。

然后直接在这个分镜基础上生成分镜图片、分镜视频,一气呵成。
简单、无脑。

甚至是一句话,也可以创建一个有特效、有分镜、有多镜头的短视频画面。

这个效率是相当惊人的。
更不要说 无限画布 + 多并发。同时 20+ 个生视频在跑,这边我还可以继续操作生图迭代场景。

说到生图。
LibTV 也是真的很猛。
就拿这个多角度编辑器来说,选择一个画面后,我不需要再想提示词去抽下一个画面的卡。
我只需要使用多角度编辑器把摄像头定位到我需要的画面,然后通过下个场景的变化提示词就可以生成。

就是这么简单。
两张仅仅角度不同的画面,可以插入到首尾帧视频里,视频的一致性更高,自然过渡更顺滑。

还有刚才那个羽毛的旋转视频。
我只做了一件事情,旋转与镜像。
这个功能让我无需生图抽卡,就可以直接把视频画面对调,然后首尾帧实现视频的反转效果。

还可以水平翻转,搭配老鹰做一些空中盘旋的视觉镜头,效果也是相当不错的。

其它的还有一些很强的生图能力,比如25 宫格连贯分镜、剧情推演四宫格、画面演化等等,帮助了我节约了很多想剧情推演的时间。
AI 直接可以理解当前画面的剧情发展需求,帮我们推出最合理的方案。

25宫格分镜,更是要剧情有剧情,要特写有特写,要场景有场景。

三、人物活起来,AI 演员一步到位
都说现在 AI 演员不好弄。
AI 生成的训练模型太完美,一眼假。
真人明星又有版权,不能随便用。
LibTV 针对这个问题,进一步优化了主体库的功能。
这是一个可以快速生成主体素材的地方,有人物、有场景、道具、特效等等,AI 演员是它的一个核心。
随便使用一张 AI 生成的数字形象。
把它加入到主体库里,然后通过智能生成主体描述(类似提取图片提示词),就可以快速形成这个人物的形象描述。

然后我们可以智能补全这个主体的多个视角,AI 会随机生成 9 张图片,在这里可以勾选最满意的部分,充实这个人物。

这样这个主体人物就丰满了。
未来随时随地都可以在不同的场景、画布下去调用,一致性超级高。

不仅有人物形象。
LibTV 连人物音色也帮我们准备好了。
官方内置了五种有趣的音色,此外还支持我们本地录音上传。
这样这个人物就拥有了你想要的克隆音色。
把自己代入到短剧里,真的想象就很激动。

值得一提的是,LibTV + Seedance 2.0,还将开放真人授权,这应该是 Seedance 2.0 目前唯一可以使用真人素材的一个方案。
当然,真人素材的授权肯定要合法合规,要经过官方审核才可以使用的。
四、AI Agent Skill 再升级,小龙虾也能跑 SD2
之前,LibTV 在视频圈内首个发布了 LibTV Skill,让 AI Agent 可以调用 LibTV 的 API 来使用画布,生成图片、视频。
现在 Seedance 2.0 上线后,这个 Skill 也进一步升级了。
一句话,安装。
一句话,做视频。
还在说 openclaw 没使用场景?
最佳实践:
自动下载:任务完成后,使用 download_results.py 将图片/视频批量下载到本地,再同时向用户展示 本地文件路径 和 项目画布链接(projectUrl)
增量轮询:使用 --after-seq 参数进行增量拉取,避免重复获取已处理的消息
项目管理:当需要隔离不同任务时,使用 change_project.py 切换到新项目
文件上传:在发送生图/生视频指令前,可先用 upload_file.py 上传参考图片或素材,获取 OSS 地址后再一并传入消息

总结
说实话,作为一个连 PS 都用不利索的理科生,能独立完成一支动画短片,这事儿放在一年前我想都不敢想。
但 LibTV+Seedance 2.0 让我信了——创作这件事,真的不需要"科班出身"这个前提。
你不需要会画画,不需要懂分镜,甚至不需要知道什么叫关键帧。你要做的,就是把脑子里那个模糊的画面,用文字描述出来,然后看着它一点点变成现实。
理科生做 AI 视频,我觉得对比文科生,差距还是很明显的。
尤其是导演、编剧等科班出身的。
大家对画面、审美、语言的理解不在一个层面的。
这个东西可能有个例,但是对于大多数人来说是这样的。
就像文科生的理科思维,一定是比理科生的平均水平要差的。
老黄前段时间说了一句话,说文科生会是 AI 时代最大的赢家。

我深以为然,但我觉得窗口期并不久。
因为随着越来越多的大模型发布,随着越来越多的优秀 Agent 和大模型强强联手。
大模型可以帮助我们理解的、掌握的、自动完成的任务也越来越多。
就比如 LibTV + Seedance 2.0 的这次组合拳。
这个差距会不断缩小,而理科生能凭借超强的学习能力,快速摸索到其中的诀窍。
这也是我对自己想说的。
AI 时代的发展是趋势,是不可避免的。
那些说 AI 是泡沫,对普通人没用的话的人。
还没有真正意识到,或者说是在自欺欺人。
先体验、先用,不断学习、不断进步,只会给自己带来好处,没有坏处。
最后,关于 AI 视频,可以去试试。
我不是说"错过等一年"那种套路,而是 —— 如果你心里一直有个想讲的故事,现在可能是成本最低的时候。
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
