最近两周,B站的AI区被同一只"海螺"刷屏了。打开任何一个ComfyUI相关视频,评论区都在问"求H3整合包";小红书上"MiniMax-H3保姆级教程"一天能冒出来十几篇;连弹幕都在刷"八月AI真神"。
让圈子这么躁动的事很具体:7月31日,MiniMax发布新一代视频生成模型海螺H3,官方当场承诺开源;8月3日零点,H3-Base的权重就在魔搭社区放出了下载36氪36氪。从发布到能下载,只隔了三天。有知乎博主引用Artificial Analysis的榜单数据称,H3在视频编辑榜排到全球第一(Elo 1130),超过了Google Veo 3.1——排名大家可以自己再去核实,但社区的热情是实打实的:微博有网友形容,“这两天花头多得跟魔兽世界大版本更新插件一样,一会一样好东西冒出来”知乎36氪微博。
这波热度背后是一个真正的变化:视频生成第一次出现了"开源权重+原生音频+可用画质"三样齐全、普通显卡真能跑起来的模型知乎。之前本地跑视频生成,要么画质像PPT,要么只支持低端显卡跑不动的玩具级输出。所以这次值得认真聊一聊:它到底能在什么硬件上跑、成本账怎么算、以及哪些宣传是坑。

先泼第一盆冷水:本地部署≠全开源
很多整合包教程不会告诉你,H3其实是个三模块系统,只开源了中间一块:
H3-Context-IR(未开源,走官方API):负责理解你输入的文字+图片+视频+音频,整理成结构化提示词;
H3-Base(已开源,33B参数):核心生成模块,本地跑的就是它,输出768p视频+原生双声道立体声;
H3-Regenerate-2K(未开源,走官方API):把768p结果重生成出2K画面知乎。

所以"本地部署"的真实含义是:你本地能直出的上限就是768p,单次最长15秒,24FPS。想要2K,得再调一次官方API知乎。凡是标题写"本地直出2K""6G显卡玩转4K"的,基本可以划走,多半是引流送整合包的账号哔哩哔哩。
顺带说清两个跟普通用户有关的许可条款:一是社区许可把美国、欧盟、英国、韩国排除在本地部署权之外,这四个地区只能调API,国内用户不受影响;二是许可明确禁止拿H3做微调蒸馏、禁止用它的生成内容去训练别的模型。个人自媒体随便玩,要做商业产品先查条款知乎。
你的显卡够不够:社区实测汇总
这是大家最关心的问题。我们把知乎、B站、微博上这两周的实测数据汇总了一下,比单看任何一篇教程都全:
门槛结论:8G显存能跑但慢,12G起步,16G受限,24G是家用甜点线知乎。
RTX 3060 12G(量化8步,848分辨率):10秒视频约5分钟出片,B站多人实测口径一致,相当于1秒视频花30秒算力;
RTX 4090 24G + 64G内存(INT8量化):480-540p的5秒视频约2-3分钟;不开加速节点的口径是15秒视频约8分钟,加上加速节点能压到4分钟左右;
RTX 5080 16G:有博主实测"速度视频质量都不错";也有研究生死磕16G显存,自研C++推理引擎才跑起来——16G能跑,但属于"折腾型"玩法;
RTX 5090 32G:1216×672分辨率10秒视频约10分钟;要是拉满1920×1088的15秒,接近2小时,整机功耗拉到近600W;
Mac用户:M系列芯片(比如M4)用Pinokio一键安装器也能跑,速度慢,但门槛是真的降下来了知乎。
记住一个经验值:本地出1秒视频,普通显卡要花30秒到2分钟算力知乎。第一次跑还要从硬盘加载几十G的权重文件,会额外慢一截,第二次起才正常。权重文件本身也要占地方:量化版压缩包大概26G上下,BF16完整版50G往上,SSD至少预留100G知乎。
成本账:本地出片到底省多少
这是最"值得买"的部分,我们按三条路线算给你看(价格来自知乎博主整理的官方口径,以官方实时价格为准):
路线一:官方API(不折腾)。 2K官方原价约0.8元/秒,会员折算下来768p约0.23元/秒、2K约0.4元/秒,活动期768p最低到过0.1元/秒。一条15秒2K视频约3元,10秒768p约1元知乎36氪。

路线二:本地部署(折腾但无限次)。 以4090为例,出一条5秒视频约2-3分钟,按家用电价算纯电费不到2分钱。真正的成本是你得先有一张够格的显卡,以及每条视频几分钟的等待。
路线三:对比闭源会员。 同一篇实测文章里给的对标是:即梦Seedance 2.0生成15秒1080p约44.6元——H3的API价格已经便宜了一个数量级,本地部署更是把单次成本打到电费级别知乎。当然也要说句公道话:微博有博主直言"H3其实不错,当然是比不上Seedance 2.0的,但它是开源的,可以多抽卡"微博。画质差一档,靠免费多生成几次找补,这就是开源的玩法。

划一下盈亏平衡的感觉:如果你一个月就出十几条玩玩,直接API或者用现成会员更省心;如果你是天天出片的短剧、漫剧、自媒体工作流,一天几十条的量,本地部署的电费和API费用的差距就是每月几百块起步。小红书那位说"不用积分,慢慢搓"的博主,过的就是后一种日子小红书。
四个坑,装整合包之前先看
"本地2K"是假的。前面说过了,2K重生成模块没开源,本地直出最高768p。想上2K的正解是"本地出768p草稿+API精修"的混合方案知乎。
整合包市场很乱。这波热度里大量账号靠"关注+私信领整合包"涨粉,标题一个比一个夸张(“提速950%”“6GB新王”)。优先看ComfyUI官方仓库(Comfy-Org/MiniMax-H3)和魔搭的模型页,工作流用官方模板库里的T2V/I2V/R2V三份,别从来路不明的网盘包起步哔哩哔哩。
加速节点有代价。社区主流的提速方案是SageAttention加EasyCache两个节点,15秒视频能从8分钟压到4分钟左右,但有网友反馈画质会轻微下降。建议先默认跑几条对比,再决定开不开。另外装之前先nvidia-smi清场,关掉llama.cpp这类占显存的本地模型服务,不然容易卡死知乎。
环境报错九成是Python和驱动的锅。社区经验:Python用3.10或3.11单独建环境,显卡驱动更到最新再跑。ComfyUI版本必须0.30以上才有H3节点。
不同人怎么选
显存8-12G:能跑量化版,但一条视频等5-10分钟,适合先验证自己是不是真有需求,别急着升级显卡;
显存16-24G:本地部署的甜蜜区,量化版+加速节点,当生产力工具已经成立;
Mac用户:Pinokio路线可以尝鲜,做主力生产力还差点意思;
没显卡的:先走API把流程跑通,确认需求是真的高频,再考虑硬件的事。最近显卡和内存行情都在涨,为了一时上头买新卡,这笔账不划算知乎。
最后给几个值得继续盯的信号:官方的稀疏注意力还没开源(开源了本地速度还有一波提升空间)、2K重生成模块官方说后续会单独开源、量化方案这两周迭代飞快。这三件事任何一件落地,"本地跑视频"的门槛都会再降一截——到那时候再回头看今天这篇账,会更有意思。