国庆这半个月,B 站 ComfyUI 分区被同一个模型刷屏了。搜「MiniMaxH3」,一周内能翻出三十多条新视频:「8GB 加速 600%」「4G 显卡玩转」「1080p 进入 50 秒时代」「8G 低显存还支持 Mac 的 FreeVideo 开源了」。点赞、收藏、评论全线飘红——那条双节点加速视频 497 赞、705 收藏,评论区整齐得像团建。哔哩哔哩
但同一时间线里,你还能看到完全不同的另一批汇报:「实测 5080 16G + 64G 内存跑不动」,「T8 的工作流没 24G 压不住,3080 20G 都 99% 卡得很」。做 RimWorld 动画的老哥则说「素材 300 份、通宵一周,连 720p 都到不了」。哔哩哔哩
一边喊 4G 能跑,一边喊 5080 跑不动——两边说的都是 H3,但过的根本不是同三道门槛。想靠它停掉视频订阅、或者接漫剧单的,先把账对完再动手。
先说底账:官方开源的是「768P 这一半」
H3 是 MiniMax 7 月底发布、8 月 3 日正式放权重的全模态视频模型。官方规格很诱人:文本、图片、视频、音频能一起塞进上下文,输出 4–15 秒、24 帧、带原生立体声的视频,短边默认 768。真正的 2K 靠 H3-Regenerate-2K 再生成流程,而官方仓库写明:这个 2K 模块和负责多阶段理解的 H3-Context-IR 都不在这次开源里,只给 API 验证。微博知乎
所以「开源 = 本地拿到完整 H3」是个误读。你本地能跑的,是 H3-Base 的 768P 段;社区教程里那些「直出 2K」「4K」,本质是外接超分和再生成模型的补作业。
部署门槛官方文档也没含糊:严肃路线是 SGLang 示例里的 4 张 H100/H200(单卡峰值 49.8–94GB),或者 2 张 RTX 5090 配 384GB 级主机内存——即便这套顶配,跑一条 1344×768、5 秒、50 步的请求也要约 560 秒。ComfyUI 这边从 0.30.0 起原生支持,提供了 int8、NVFP4 AWQ 等量化权重,16G/24G 卡的定位是「实验区」,不是「生产区」。知乎
第一道门槛:装载——真正吃显存的不是视频模型
4090 玩家的踩坑帖把账摊得很平:ComfyUI 日志里加载 H3 本体要 19995MB,文本编码器 MiniMaxH3TEModel 还要 14956MB——两个加起来 34GB 级,这才是「开源了但普通卡装不下」的真相。他的 4090 之所以鼠标键盘一起失联、系统日志 Kernel-Power 41 硬重启,是因为前面生图用的 RealVisXL 没卸载,两波模型叠穿了 24GB。知乎

社区最实用的一个「降门槛」也被标题党带偏了:那个把显存从 15.7GB 砍到 4–5GB 的方案,不是压缩了视频模型,而是用 Qwen3-VL-4B 替换掉 32B 的 CLIP 文本编码器——大头从来在「看懂你提示词」的那一步,不在「生成画面」那一步。229 个人收藏了这篇,评论区都在问「画质掉多少」,官方实测帖没给答案。知乎
另一笔隐性账是主机内存。16G 显存党的原话:「显存和内存都是满的,估计都写虚拟内存了,担心把 SSD 给写坏了」。低显存跑 H3,往往是用内存 offload 换的——SSD 寿命和等待时间,不会出现在任何整合包标题里。知乎
第二道门槛:抽卡——「50 秒时代」和「通宵一周」之间差了什么
速度端确实有真进展:有人 5070Ti 上「随便找了个加速版本」,15 秒 864×480 的片段两三分钟出片(下表就是 ComfyUI 里可选的尺寸档位)。知乎

DGX Spark(128GB 统一内存)10 月初测多参考图替换,9 个用例全过,但那是 8 步加速档。代价写在另一批实测里:官方工作流在 5070Ti 上是 5 分钟一条 5 秒。为了分段续写,每段 /free 卸载再重载 H3,一段白扔 3–4 分钟。「600% 加速」的视频评论区没人聊画质,因为那区里 405 条评论几乎全是「一键三连求整合包」。不过加速生态里也有可复现的硬数据:32G 卡的实测里,H3 原生 20 步采样跑 736×1280 高清 5 秒要 830.13 秒,换用专属的 Turbo LoRA 加速后压到 370.84 秒,低清档 5 秒更是进到 61.44 秒——「50 秒时代」不是演示噱头,但前提是你有 32G 这张门票。知乎知乎知乎哔哩哔哩知乎

质量端,国庆这周评论区比标题诚实。高动态方向,新出的 Dasiwa V3 被追评「橡皮感强、特效拖影、糊」,有老哥通宵测完说 VBVR 第一视角「镜头一下往前一下往后,完全无法用」,社区的共识居然还是几周前的 25-49 版最舒服。人物替换那边,「抽卡情况仍然存在,通用提示词效果不行」。FreeVideo 这种主打傻瓜安装的开源项目,用户实测反馈「效率和高动态质量不是特别高,最大优势是整合后的傻瓜安装」,甚至「视频中间频繁出现 free video 字样」——整合包自带的坑,标题不会写。哔哩哔哩哔哩哔哩哔哩哔哩
第三道门槛:商用授权——「免费」后面还有一行小字
这是三条门槛里最少被教程提的一条。ComfyUI 官方 8 月 29 日把规则写得很清楚:在 Comfy Cloud 上生成,已自带商用许可,不用买;但要在自己硬件上商用,需要通过 Comfy 单独获取 H3 本地商用授权,授权范围包括生成内容归你、支持微调与 LoRA 训练、代理公司和工作室可用于客户项目。微博
换句话说:自己玩,开源权重随便折腾;但 B 站那些「学会直接落地做漫剧变现」的教程,从第一条起就没讲「本地接单要先过授权这关」。对只想停掉月费订阅的用户,这倒不是成本问题;对真打算接单的漫剧党和工作室,这是一笔要先问价的账。哔哩哔哩
按显存对号入座,别按标题下单
把官方文档、知乎实测帖和这周几十条 B 站汇报拼起来,各档卡的真实定位大概是:
8G 及以下(含 Mac):只适合 FreeVideo、CLIP 替换这类社区兜底方案,产出是「验证流程 + 低分辨率玩具」,别对标云端成品。
12G(3060 级):ComfyUI 官方那句「在 3060 这样的显卡上就能本地运行」指的正是这档 768P 实验区,能跑通,快慢随缘。微博
16G(5060Ti/5070Ti/5080):能稳定出片的主力档,但 50 步官方工作流是分钟级每条,且主机内存最好直接 64G 起步——32G 的帖子已经出现虚拟内存顶到底的汇报。
24G(3090/4090):接近「小生产线」的唯一消费级档位,前提是执行卸载纪律:别叠模型、多段共用一次加载。不想堆两张卡的话,上面实测数据里那张蓝戟 B65 TF 这类 32G 显存的专业卡,是单卡够到生产线的门票。
128G 统一内存(DGX Spark 类):多参考替换 9/9 全过,但那台机器本身就是五位数的预算档位,那是「租算力」问题,不是「跑 H3」问题。
下一步与观察信号
先别买卡。H3 这轮「人人能跑」的热度里,标题是整合包生意,评论区才是实测现场——而 ComfyUI 模板库里这套 H3 工作流全景,本地和云端跑的本来就是同一套:

三个动作建议按顺序来:第一,先在 Comfy Cloud 模板里免费试一轮 768P 直出,确认这个质量档位配不配得上你的项目,商用许可还白送;第二,本地党先跑 CLIP 替换 + 量化权重这两件套,用你自己的卡出一版真实「每条耗时 / 失败率 / 内存峰值」再谈升级;第三,接单党把本地商用授权的条款问清价格再排期。
值得继续盯的信号有三个:H3-Regenerate-2K 和 Context-IR 会不会补开源(2K 本地直出与否的分水岭)、社区高动态工作流能不能解决 VBVR 的运镜抽搐和拖影(现在还是 25-49 时代)、以及加速生态(Veda、双节点)会不会把「50 秒时代」从 8 步演示变成默认工作流。三个里任何一个落地,上面这张显存表就得重画。哔哩哔哩