当前位置:
AIGC文章详情

一支AI MV六天640万播放,用的还是内测工具:8月普通人给一首歌做MV的三条路

源自48位全网作者

08-21 19:55

这两天做MV的圈子,大概率都刷到过《一切正常|異常なし》。这支讽刺日本社会"看见也不看,知道也不说"的AI MV,8月15日发在B站,六天播放量突破640万,点赞50万,收藏超17万,转发到X上的浏览量也接近200万。哔哩哔哩知乎上"两天400万播放"的讨论帖都成了小热点。知乎

但对MV制作兴趣用户来说,真正值得看的不是热闹,而是UP主自己在置顶评论里亮出的制作方式:这条片子用的是updream——B站官方还在内测的AI视频工具,视频模仿上世纪老日本动画风格,连歌曲都是AI唱的(有听众在评论区靠一处日语读音瑕疵鉴定出来的)。一条被评论说"快到出版水平"的MV,背后没有传统摄制组。哔哩哔哩

还有一条高赞评论把现在的AI MV说得最透:这片子起承转合顺畅无比,靠的是编剧的实力,AI就是为创作者而生的。哔哩哔哩工具负责执行,人负责立意和风格——这支爆款证明了AI MV能出圈,但也说清楚了出圈靠的是什么。

那为什么8月值得单独写一篇?因为这个月"做一支MV"的成本结构,被三件事同时改写了:

第一件,模型层降价。7月31日MiniMax发布新一代视频模型H3,官方口径API定价是同类产品的三分之一;8月3日权重正式开源,华为昇腾、AMD、Intel和HuggingFace等当天跟进适配。微博H3最大的特点是声画一体:4到15秒、24帧的画面原生带32kHz立体声,支持21:9到9:16多种画幅——对做MV的人来说,这意味着可以直接按着歌的情绪生成"带声音的画面素材"。知乎第三方平台的活动价一度低到768p每秒0.1元、2K每秒0.2元,不到Seedance 2.0(约1.5元/秒)的一半。微博

第二件,平台层送钱。OiiOii在7月下旬上线"MV创作"功能后,8月14日联合MiniMax办了AI MV创作大赛:20个现金奖励名额、150份免费H3创作算力,报名审核通过直接发价值200元的H3专属创作基金到你的账户。小红书注意时间:算力申请8月23日23:59截止,只剩最后几十个小时。

第三件,抽卡问题有解了。8月17日updream正式上线"预演台":传一张参考图生成3D白模场景,先摆人物走位、设机位、预演灯光景深,调好了再交给模型渲染。小红书社区反馈很直接——“再也不用写永乐大典式的提示词”“抽卡率大幅降低”。8月21日,预演台创作大赛也开了。小红书三件事连起来就是一句话:模型在降价,平台在降门槛,还都在用比赛补贴抢创作者。对想做第一支MV的人,现在是这两年成本最低的窗口。

一支AI MV六天640万播放,用的还是内测工具:8月普通人给一首歌做MV的三条路

具体怎么做?按投入程度分三条路:

路线一:一键直出平台,适合零基础、想先看到成片的人。以OiiOii为例,上传一首歌,AI理解歌曲内容和情绪,自动生成匹配的角色、画面和分镜,组成完整MV,全程0抽卡,提供剧情故事、视觉特效、动感表演三种类型。小红书连歌都没有的话,它的智能画布还能先帮你生成一首。有已经做过动画版和真人版两支MV的创作者评价,对AI视频新手"0门槛直接上手,全程无痛"。成本上平台是积分制,但如果你赶在8月23日前报名创作大赛,审核通过能领约200元的创作基金,第一支MV基本等于零成本。

一支AI MV六天640万播放,用的还是内测工具:8月普通人给一首歌做MV的三条路

路线二:可控型平台,适合有分镜要求、做剧情MV或饭制的人。一键直出的短板是不可控——人物漂移、机位不合心意。updream预演台给的答案是把"抽卡费"换成"排练费":白模片场里把镜头全部调好再生成。tapnow走节点式画布路线,分镜、光影都能拆成独立节点;libTV的脚本和分镜能力强,但视频生成仍要消耗积分抽卡。小红书提醒一句:updream还在内测,需要邀请码(社交平台搜"updream邀请码"能找到不少),消耗积分制。

一支AI MV六天640万播放,用的还是内测工具:8月普通人给一首歌做MV的三条路

路线三:开源H3自己跑或走API,适合有显卡、爱折腾的技术向玩家。先泼盆冷水:这次开源的是H3-Base权重,本地默认目标是768p,2K重生成和多模态理解组件目前只在官方API上。GitHub官方SGLang部署示例是4卡起步,消费级显卡只能算"实验性推理",社区有人说量化后3060能跑,但"非常缓慢"。许可证也别忽略——它不是宽松的开源协议,商用收入超一定规模要另行授权,还不能拿输出去改进其他模型。知乎没多卡机器的,老老实实用云平台API:活动价768p约0.1元/秒,一支3分钟MV按20到40个镜头算,纯生成成本也就几十元量级。微博Mac用户还可以留意Redis作者antirez开源的h3.c,专门给Apple Silicon做了原生推理。

一支AI MV六天640万播放,用的还是内测工具:8月普通人给一首歌做MV的三条路

一支AI MV六天640万播放,用的还是内测工具:8月普通人给一首歌做MV的三条路

把账拉直对比一下:传统拍一支MV,低成本独立制作一般也要几万元起步(人员、灯光、场地、后期),商业制作几十万起。AI路线里,一键平台用积分(配合活动可以0元起步)<云API几十元量级<本地部署(电费+显卡折旧,抽卡自由但门槛高)。有知乎从业者测算"一条30秒视频AI比传统拍摄便宜约97%"——样本是他自述的,参考即可,但数量级差距是社区共识。

坑也提前列好:

  1. 抽卡是最大的隐形成本。没有预演/锁定机制的平台,一个镜头重roll三五次很常见,积分烧得比你想的快;

  2. 人物一致性。做剧情MV先把角色立绘/参考图准备好全程锁定,H3的多参考输入(最多9图+3段视频+3段音频)就是为这个设计的。知乎

  3. 卡点别指望一键完美。自动对齐节拍没问题,但副歌情绪转折、bridge段落通常需要手动调整镜头;

  4. 版权和平台规则。AI音乐和AI画面各有各的授权条款;《一切正常》这类讽刺题材容易爆也容易起争议,发布前看一眼平台内容规范;

  5. 警惕软文。最近知乎上一批"AI视频工具横评"是平台自发的推广稿,报价一律以官网为准。

最后按人群给行动清单:

  • 手里有歌、想赶这波:8月23日23:59前去oiioii.tv报名OiiOii×MiniMax创作大赛的算力申请。小红书用MV创作功能出片,带上参赛话题,200元基金够磨出第一支成品;

  • 要镜头控制、做剧情或饭制:先搞updream邀请码,用预演台把分镜走一遍白模再渲染;节点流选手试tapnow;

  • 有GPU爱折腾:拉H3权重跑ComfyUI或Diffusers,记住本地目标768p,2K走官方API混搭;

  • 纯围观:盯两个信号——H3后续放出稀疏注意力推理(速度和成本还会降一档),以及updream什么时候结束内测全面开放。知乎

640万播放证明了AI MV能火,但评论区也说了实话:火的不是工具,是"看见也不看,知道也不说"那个立意。工具侧还在降价补贴,这可能是普通人做第一支MV门槛最低的窗口期——一首歌,一个下午,就够了。

内容由AI生成

精选参考来源

1. 《一切正常|異常なし》MV:当所有日本人都说没问题 那问题大了

2. 如何看待B站讽刺日本的AI歌曲《一切正常|異常なし》MV仅2天斩获400万播放?

3. OiiOii MV创作大赛正式开启!算力我们买单

4. updream 预演台正式上线!从抽卡,到导演

5. updream,libtv,tapnow,选哪个?

6. MiniMax H3 模型本地部署指南:从开源权重到全模态音视频生产

7. 【MiniMax H3正式开源】财联社8月3日电,MiniMax H3模型正式开源。华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face等开发社区和云推理平台同日完成相关适配支持。MiniMax H3是一个通用型全模态生成系统,在Artificial Analysis榜单中视频编辑能力排名第一,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15 秒、带有原生立体声音频的视频。

8. 众所周知,AI 视频模型的老大哥是 Seedance。一直是一骑绝尘,无人能敌的存在。但最近 MiniMax H3 发布,这个赛道就变得有意思了。在 LibTV 上 H3 又是全网首发,在活动期间 768p 分辨率才一毛钱一秒,2K 分辨率也才两毛,不到 Seedance 2.0 的一半。H3 的能力本身就很能打,成本又降了下来,量变就会引发质变。更关键的是,H3 会在未来几天内开源。过去这两年,大语言模型开源已经成为了常态,一家接着一家,但视频这边能打的几个都是闭源。视频模型的开源,这绝对是里程碑级别的存在。话不多说,咱们直接在 LibTV 上,边测边聊。# 实测先来看下 H3 的关键参数,H3 支持 5 到 15 秒生成,24 FPS 输出,原生双声道。21:0,16:9,4:3,1:1,3:4,9:16 这些主流画幅全覆盖。单次最多输出 9 张图片,3 段视频,3 段音频,混合参考素材总数上限 12 个文件,提示词支持到 7000 字符。第一个实测,我用 H3 和 Seedance 2.0 做了一组对比。直接把难度拉满,用同样的提示词和图片素材,让他们生成游戏 UI 动效。输入是 3 张图片,包括角色图,UI 图和完整游戏界面图。结果我是真没想到,H3 的表现甚至盖过了 Seedance 2.0。这个是 H3 的效果。这个是 Seedance 2.0 的效果。结果明显是 H3 更好,UI 面板的滑入滑出很干净,菜单文字没有糊,装备切换的顺序很丝滑,最后环境加载那一段的空间关系也是对的。Seedance 2.0 这边反而出现了 Bug,切换装备时多出了一条手臂。积分花费上分别是 198 和 405,在这个实测的表现上,H3 明显超过了 Seedance 2.0。第二个,我想实测下最近很火的玩法。将 2D 卡通形象和 3D 场景的融合,素材很简单,输入的图片是猫咪的表情包和一张桌面背景图。值得一提的是,LibTV 里可以很方便的同时抽 4 张卡,甚至 8 张卡。主打一个效率拉满。最后,我选了一个综合效果最好的。不得不说,H3 的表现依旧稳定,这里面的声音也都是模型直出的。画面和声音是推理完一块产出的,它知道这一帧画面里需要对应什么声音。你不用生成完画面再去自行配音,也不用担心动作和音效会错位。做短剧的团队应该最懂这个价值,因为玩 AI 视频有时候还是需要抽卡的,抽卡本来就是概率游戏。以前你是一次一次抽,现在在 LibTV 里,你可以一次开四张牌再挑那张最好的。第三个,我测试的是爆款视频复刻。为了增加难度,还是真人出镜的多人场景。输入的素材有两张人物图,一张背景图,和一个初始视频。提示词很简单,让人物动作,表情和表演节奏严格参考初始视频,再分别明确人物和场景的对应。最后的效果是这样的。这个效果真的有点离谱了,H3 要比想象中还要猛。表演节奏,人物动作,光影氛围,甚至视频特效,都迁移得非常精准,几乎挑不出任何毛病。输入的人物和环境的一致性,也是拉满的。更重要的是,这是一次直出的效果,我完全没有抽卡。第四个,咱们继续上难度。让它来一条一镜到底,中间频繁的切换画风。考验它长时间的连续性,和画面内部的剧烈变化,输入的素材只有一张人物图。直接来看效果。看到最后产出的效果,我还是觉得非常惊喜的。看来很难难倒 H3 了,我写了 800 多字的提示词,它的指令遵循还是非常好的。无论是场景切换,镜头切换,还是频繁的画风切换,都非常丝滑。说明它确实能理解非常复杂的提示词,并且还能知道在同一个空间里,如何优雅丝滑的过渡。最后,必须来夸一夸 LibTV 的一整套极致的画布体验。各种参考素材和输入输出的连线,图片和视频节点关系,整条链路一眼全部看得清清楚楚。想要换个参考,改一下节点重新跑就行,其他的内容完全不受干扰。再加上咱们之前讲过的 Agent 和各种专家级的 Skill。坦率地说,LibTV 绝对是我心目中创作领域的最佳产品了。# 尾声Seedance 2.0 发布之后的大半年,AI 视频这个赛道其实挺安静的。MiniMax H3 出来之后,这回就变得热闹和有趣了。但我更想说的,不是谁打败了谁。真正的变化是,当一条视频的成本打下来之后,创作这件事的性质就会改变。之前很多舍不得尝试的想法,现在可以毫无顾忌的玩起来。再加上模型开源,就是想把能力交到更多人手里,这就是技术真正的善意。写到这里,我还是会想起第四条片子里,那把小钥匙在手里长成剑的一瞬间。当时看到后,我愣了一下。就像以前你只是脑海里有一个念头,但现在它能被你的手握住了。#how i ai##科技先锋官#

9. https://github.com/MiniMax-AI/MiniMax-H3

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章