过去两周关注本地部署圈的人,大概都躲不开 MiniMax H3。7 月 31 日发布、8 月初开放权重,到今天正好开源第十五天,官方 HF 仓库累计下载已接近 200 万。知乎连 Redis 的作者 antirez 都亲自写了个 C 语言推理引擎,把 H3 搬上了 Mac。知乎但越是看到"8G 显存就能跑""1 分钟部署"这类标题,越觉得有几件事得先说清楚:8G 到底能跑什么、2K 从哪来、为什么有的人根本不能用这套权重。我把知乎、小红书、GitHub 上的实测帖和仓库数据核了一遍,今天把部署前该知道的事一次讲透。
先搞懂:你本地下的不是"完整版"
H3 是三个模块串联的系统,只有中间那块开源了:H3-Context-IR 负责理解图文音视多模态输入,未开源;H3-Base 是 33B 参数的生成主体,你本地能跑的就是它,输出上限 768p、4-15 秒、24 FPS 视频加原生立体声;H3-Regenerate-2K 负责把 768p 送回重生成 2K,同样 API-only。知乎所以"本地跑 2K"的标题看看就好,本地天花板就是 768p,想要 2K 只能"本地 768p + API 超分"的混合方案或者全托管。完整版形态其实挺猛:多模态参考最多支持 9 张图加 3 段视频加 3 段音频,音画同步直出。知乎
H3-Base 又分 FL2VA(文生视频、首尾帧生视频)和 Ref2VA(全能参考)两个版本。看 Comfy-Org 转换仓的文件清单,BF16 完整权重单个就要 66.3GB,量化版里 pruned int8 约 21GB、完整 int8 约 34GB、fp8 也是 21GB——教程里说的"下量化版"指的就是这一组,BF16 基本只属于 24G 以上显存的用户。这套模型的热度不是错觉:截至 8 月 14 日,Comfy-Org 转换仓累计下载已经超过 1176 万。知乎

到底多慢?实测速度横评
显存门槛社区的共识是:8G 是入场券,显存不够会自动换到内存、不崩但慢;12G 更舒服,24G 随便跑。知乎但"一条视频几分钟"这件事,不同加速组合差距大到离谱。
有人用 4090 默认流程跑一条 15 秒视频花了 20 分钟。知乎而教程侧的实测是量化版加默认节点约 8 分钟,叠上 SageAttention、EasyCache 这类加速节点能压到 4 分钟左右,代价是画质轻微下降。知乎
小红书上有用户用 RTX 4070 SUPER 12G 做了九组对照实验,结果更直观:默认 PyTorch Attention 约 603 秒,换 SageAttention 约 324 秒,再叠 Turbo 四步加速和 TE-Speed 能压到 184 秒。小红书所以问"H3 慢不慢"之前,先问自己打算配什么加速栈:日常出片 Sage 加 Turbo 四步性价比最高,求稳就 12 步 Beta 加 Sage。目前已经有人跑通的路径包括双 RTX 3090、RTX 5070 Ti、RTX 5060 Laptop 8GB,甚至 AMD RX 7800 XT,覆盖面比想象中广。

Mac 阵营这次没被落下
Mac 端的进展比很多人预期快:有人在 M3 Ultra 上自组 ComfyUI 优化工作流,512×512、22 帧的短片 28 秒就能生成,比社区适配版 h3.c 的约 50 秒还快。知乎480p 5 秒视频 3 分钟出片,对创作来说已经可用。
但别上头:同一套工作流 720p 15 秒要跑 38 分钟,而且要求 64GB 以上统一内存,低配 Mac 暂时只能围观。知乎
更硬核的是 antirez 的 h3.c:靠 SSD streaming 只让两个 DiT block 常驻,把受跟踪存储从 36.5GB 压到约 2GB,代价是完整 block forward 慢 26%-84%,目前还是瞄准 128GB 级 M3 Max/M5 Max 的开发者级工程,版本号 0.1.0-dev。知乎普通用户想省事,门槛最低的是 Pinokio 这类一键安装器,M4 Mac 也能跑,不用写一行代码。
社区踩过的坑,教程里都没写
第一个坑是音频。多位用户反馈生成音频开头有爆破音或"边界幽灵"——每段音频以一个毫秒级的尾音片段开头,社区的缓解办法是剪掉开头 50-200 毫秒再做交叉淡入,官方至今没有回应;原始权重与 diffusers 版 checkpoint 不一致的 issue 也还挂着。知乎做中文口播的还要注意,H3 说指定中文台词的稳定性偏弱,serious 做短片大概率要后期 TTS 配音。
第二个坑是许可协议。H3 用的是社区许可协议,美国、欧盟、英国、韩国的用户不能直接用开源权重,需要单独拿授权;国内个人折腾不受影响,但做出海产品前一定要先看清楚。知乎下载权重时,这条协议就挂在仓库最顶上。

第三个坑是热度和现实的差距。本周官方 GitHub 仓连续出现两个质疑"星数造假"的 issue,声称一周暴涨约 3585 颗星,官方未回应,看热度数据时得留个心眼。知乎反过来也有好消息:官方训练时用的原生稀疏注意力还没开源,首版只提供全注意力推理,本地速度后面还有官方优化空间,早部署的人能等到这波红利。知乎
谁该部署,谁该老实用云
8-12G 显存:先跑起来玩,下量化版,别碰 BF16;24G 显存或双卡:可以当生产力,加速节点对比后再开;64GB 以上统一内存的 Mac:工作流已经成熟,体验比预期好;真要做 2K 商单交付:混合方案最现实,本地免费出 768p,只在最后超分那步为 API 付费。时间紧只想拿成品的,官方 API 出 2K 社区传的价格约 0.8 元/秒,一条 15 秒视频十几块钱。知乎不过官方费率页目前还是 404,真下单前以社区实测价为准。知乎
最后附个彩蛋:8 月 13 日 MiniMax 还开源了音乐生成模型 Music3,能一次生成最长 5 分钟、带人声带编曲的完整歌曲,已经有人把它和 H3 拼成"全本地视频+音乐"流水线。知乎今年本地部署圈的节奏基本一周一版,早部署早享受,但记住:部署适合自己的那档,才是真的值。