如果你这周刷过B站或小红书,大概率被MiniMax H3刷过屏:国风"天宫巨月"在各大平台刷屏,一堆"8G显存一键整合包"教程动辄十几万播放,评论区还有人在喊"Seedance退钱"。H3在7月底发布并同步开源后,迅速成为AI视频领域的现象级产品。微博
先说结论:这波热闹是真的,值得关注;但"开源=AI视频免费"这个说法,只说了前一半。后一半是——能跑不等于好用,好用不等于适合你,而且开源的也不是完整版。我把这周的官方AMA问答、B站实测、API价格和开源协议翻了一遍,按显卡档位替你算好了账,看完你再决定要不要入坑。
先搞清楚:H3到底开源了什么
MiniMax H3是目前第一个冲进全球第一梯队的国产开源视频模型:最长15秒、最高2K、带原生立体声音频,文本、图片、视频、音频都能当参考输入。在第三方评测机构ArtificialAnalysis发布的视频模型榜单中,MiniMaxH3的视频编辑能力获得1127分,排名全球第一。36氪

但重点来了:8月3日,MiniMax宣布正式开放H3模型权重,开放的却是768p基础版。36氪团队在Reddit AMA里说得很直白——2K超分(Regenerate-2K)是独立的二阶段模型,“有计划开放,但没有时间表”;完整版的Context-IR上下文能力也还在API侧。目前开源部分以 768p 基础模型为主,2K 能力可以通过 API 和 ComfyUI 的混合工作流调用。知乎

换句话说:你能免费下载的,是"标血版";杀手锏还在官方服务器里。有UP主高强度实测两天、抽卡几百次后总结得很到位:本地部署可以试错可以抽卡,内容生产可能还得走官方API。哔哩哔哩H3开源真正改变的,是抽卡试错的成本,而不是最终交付的成本。
你的显卡在哪一档,决定你走哪条路
模型本体约60B参数,BF16原始体积约120GB,看起来跟消费级显卡绝缘。ComfyUI团队靠量化、裁权重、显存和内存之间动态卸载,把门槛硬生生拉了下来:官方介绍称,最小变体的总内存占用可从约 123.6GB 降到约 42.5GB,并能借助动态卸载在 RTX 3060 这类设备上本地运行。知乎注意,是"显存+内存"合计,不是只要42.5G显存。所以"8G显存能跑"在技术上是真的,但每一档的体验天差地别:

8G显存(RTX 3060 8G/4060等):能跑,靠极限量化+卸载。无加速时生成10秒视频要500秒以上,社区加速插件能压到200秒上下。适合先尝鲜、跑简单镜头,别指望量产。
12G显存(3060 12G/4060Ti/3080等):这周整合包的主战场。搭配加速LoRA和节点,社区报告10秒视频约300-450秒,有人晒出45秒的极限成绩,但那是牺牲画质换的,稳定性存疑。适合抽卡式创作,出片靠等。
16-24G显存(3090/4080/4090等):体验分水岭。有UP主实测4090跑720P、15秒视频单条约8-9分钟,还能同时挂两个任务,我自己用4090 24G同时挂两个任务,一条15秒的720P视频,八九分钟就能出片。知乎这个档位才谈得上"把本地H3当工具用";想碰2K,24G也吃力。
没有N卡或不想折腾:两条路。MiniMaxH3在2K分辨率下的视频生成价格为0.8元/秒,仅为业内同类旗舰视频模型的三分之一。36氪第三方平台内卷之下有的已经把单价打到一毛钱一秒;或者直接用已接入H3的各类云端应用,按次付费,零部署。
顺带提一句反常识的:有评论区的5090D 32G用户吐槽,跑int8量化依然吃力。显存大不等于无脑爽,量化方案、PCIe带宽、生成分辨率都会影响体验。
算笔账:本地抽卡 vs 云端出片
AI视频的真实成本不是"生成一次多少钱",而是"出一条能用的视频多少钱"。抽卡率摆在那里,一个镜头试3-5次是常态。
本地(以4090为例):电费几乎可以忽略,一条15秒视频抽5次卡大约40分钟。成本几乎全在时间和硬件折旧上——你已经有卡,边际成本趋近于零;没有卡,专门为它买一张4090就不划算了。
H3官方API:768P每秒不到主流模型一半,15秒抽5次卡也就几十块,适合"本地抽卡定方向、云端API出成片"的组合。
Seedance系(即梦):涨价后的Seedance 2.5(不含视频输入)为70元/百万Token,比2.0贵52%。知乎2.5多了30秒长镜头、50个多模态参考和帧级局部编辑,但如果你用不上这三样,为它多掏50%没必要;走渠道价或留在2.0/mini,成本低得多。
这也解释了为什么社区目前最理性的玩法是混合流:本地免费抽卡找感觉,确认镜头方向和提示词后,再用API或Seedance出高质量成片。
三个没人主动告诉你的坑
坑一:加速插件的数字别全信。 从Turbo V4到双时钟采样器,社区一周内把加速方案迭代了好几轮,“提速950%”"提速1000%"的标题满天飞。官方AMA的态度是:更低步数的蒸馏方案还在评估,而社区已经有人尝试 Turbo LoRA。代价同样明显:速度上去,质量可能下降。知乎还有人在评论区质疑那些"12G显存一分钟出10秒视频"的截图是不是只推理了一步。看加速教程时,认准带原画质对比的。
坑二:想靠H3接单变现,先读一眼开源协议。 协议是Royalty-Free免版税,个人和本地商用不用给MiniMax分成,输出权利也归你——这部分很良心。但硬约束同样明确:H3开源授权范围覆盖全球,但明确排除美国、欧盟、英国和韩国。知乎生成的视频也不得在这些地区使用、分发或展示,想做TikTok、YouTube出海业务的要当心;此外年相关收入超过2000万美元需另行授权,商用内容必须显著标注"MiniMax H3"。AI漫剧变现的教程满天飞,但讲协议的作者一个手都数得过来。
坑三:别被"对标Seedance"的节奏带偏。 这周的对比视频一半在吹H3吊打,一半在说"复杂运镜和运动变化H3还差得远,一个是玩具一个是生产工具"。两种说法都有真实案例支撑,官方也承认远景小脸、高频细节、参考生成的柔化问题还要改。对普通玩家的实操建议是AMA里团队给的原话:先用文生视频跑通链路,参考素材尽量喂高质量的,对白直接写进镜头描述里加引号。

这周该做什么,以及接下来盯什么
有16G以上显存:值得这周就上手,下载官方ComfyUI工作流,先用768p文生视频试,别一上来就追2K。
8-12G显存:下个整合包玩玩可以,但把它当"体验版",别投入正经产能预期。
没有合适显卡:先用API或已接入H3的云端应用按次体验,判断自己到底有没有持续需求,再决定要不要升级硬件或租云GPU。云GPU按小时计费,先租一晚上试水,比直接买卡理性。
已经在付即梦/Seedance钱的:不用急着退订。你的订阅买的是稳定出片和完整能力,H3本地目前替代不了;但调试和抽卡环节可以迁移到本地,把付费额度留给最终出片。
接下来值得盯三个信号:一是2K权重和稀疏注意力优化什么时候开放,这直接决定中端显卡能不能翻身;二是价格战远没结束,阿里的Wan3.0也已经上线。36氪它同样支持多模态输入和最长30秒的视频生成,API价格保持在主流视频模型的低价区间,字节大概率也会出2.5的入门版,云端价格下半年还有得看;三是H3 团队确认,他们计划开源一款统一图像模型。知乎它将同时覆盖文生图与通用图像编辑,时间未定,值得蹲。

一句话收尾:H3的开源把AI视频的"试错自由"打了下来,但"出片自由"还在路上。看清自己的显卡档位和需求再动手,这波热闹才看得值。