这周的B站AI区,刷屏的不是哪个新对话模型,而是一整排「MiniMax H3一键整合包」。
「最低8G显存也能流畅跑」「提速1050%」「解压即用,Win+Mac」「6G内存+8G显存,10秒视频只需450秒」……9月4日到6日,类似的标题把「最新」页灌满了,点进去大多是一套「关注+评论掉落链接」的玩法。哔哩哔哩 小红书那边更狠:一台36600元的DGX Spark接H3的活,网上说0.7个月回本。小红书
海螺H3是7月31日发布、8月3日放出权重的,到今天刚好开源一个月。如果你在做漫剧素材、短片或者MV画面,正对着自己那张4060心痒,先别急着下包。我把社区一个月以来攒下来的十几组实测数字和整排宣传语摆进了同一张账单——但在看速度之前,有一笔更基础的账要算。
第一笔账:这次开源的,到底交付了哪一段
H3官方管线不是一块,而是三段:前端H3-Context-IR(提示词深度理解与改写)、中段H3-Base(生成核心,产出768p)、后端H3-Regenerate-2K(把768p成品连同原始上下文喂回底座,重新生成一遍2K,而不是传统意义上的超分小模块)——三个模块名在官方GitHub README里都能逐字对上。GitHub 知乎「时间斗士」在开源盘点里写清楚了口径,另一篇选型避坑帖(Ahui-模型通道)独立印证了同一个缺口:开源的只有中间的H3-Base,前后两段都还是托管API,而且放出的权重是int8量化版本,原文说得很直白——你自部署部署不出官方完整效果。知乎

翻译成人话:本地能跑到的上限是768p。5060Ti上写了「七个雷全排完」血泪实测的多宝,最终定格在768×448、5秒一条;想要官方演示里那种2K+原生立体声的成片,还是得把活送回云端。知乎 官方能力口径(4-15秒、2K、24FPS、32kHz立体声、人物和环境声同时生成不用补配音)描述的也都是云端那件货。换句话说,整合包广告词里省略了一个决定性前提:跑通H3-Base,不等于跑通你看过演示的那个H3。
时间斗士还提了一个容易被忽略的技术点:H3的稀疏注意力没有开源,本地首版跑的是全注意力,天生比官方慢。这一条目前是单一来源,但它能解释为什么同样叫H3,各家本地实测的等待时间和云端「3秒出片」根本不是一个量级。
license(MiniMax H3 Community License)有四条硬边界,三个不同作者的盘点互相印证过:美国、欧洲、英国、韩国用户不能直接使用权重;商用且年收入超过2000万美元需另行书面授权;界面上必须显著标注「MiniMax H3」;不能拿它的输出再去改进别家模型。对打算全本地商用的短剧团队,最后两条要单独过一遍法务,而不是当段子看——时间斗士那句原话搁在门口:开源权重不等于开箱即用。知乎
顺带一个证据强度提醒:同一位作者晒出「开源三周2400万次下载、300+衍生模型」的同时,也记录了官方GitHub上挂着两个质疑星数造假的issue(一周暴涨约3585颗星、官方未回应)。热度是真的——B站一周40多条整合包教程、微博《大汗王朝》全本地短片(作者用的是RTX Pro 6000 96G+128G内存)都是现场。知乎微博 但引用任何「爆款数据」时,记得这个数字本身也在争议射程内。
第二笔账:「能跑」和「跑得动什么」,差着一个分辨率
社区数字最大的坑是报数不标规格。同样是3060,一条小红书笔记报「23分钟的效果」(没标分辨率和时长,收藏111),B站另一条的标题则是6G显存24G内存跑15秒耗时9650秒,把这份成绩单的规格原样摊开。哔哩哔哩 23分钟和2.7小时的差距,中间差的是你看不见的分辨率、时长和加速档位。把能对上规格的实测统一折算成「生成1秒视频要等几秒」,证据从强到弱排一遍:
H200(数据中心单例,79播放):约8倍——天花板,与消费卡无关;
5080 16G:约24倍,4分钟出一条10秒。哔哩哔哩 注意来源UP简介里只有网盘链接,这条和下一条属于引流物料,当参考不当依据;
5070 12G:约36倍(6分钟出一条10秒)——同上;
5070Ti 16G:约60倍(官方原生工作流、未加速,5分钟出一条5秒),答主的补充细节很真实:Win11下显存内存全满,「担心把ssd都给写坏了,有条件的话最好再加个16G试试」。知乎
5060Ti 16G:约36倍(768×448、5秒约3分钟),但代价是–novram全量offload+62GB内存,光Qwen3-VL-32B文本编码器就吃15.7GB,五件套权重合计34GB起,分辨率宽高必须是32的倍数,ComfyUI必须0.30.x。他的原话值得抄在所有整合包评论区:慢,但是唯一能让 16G 跑通的可靠路径。知乎
RTX 4090 24G:能进生产(博主用它产了8段短剧),但H3本体和文本编码器要一起进显存,两笔加载合计19995MB+14956MB,加起来超过34G,24G的卡靠的是卸载调度活着——前一个出图模型忘卸载,直接Kernel-Power 41强制重启。知乎 这是本月最实用的避坑细节:开源给你的不是一个模型,是一整组负载;
RTX 3060 6G:约643倍,2.7小时出一条15秒;
时间斗士的档位换算:3060 12G只能停在480p级,768p要24G起步;
「8G整合包」宣称:折算约45倍——比5060Ti的诚实实测还快25%,一块8G卡做不到,除非降分辨率+砍步数+云端补2K,而广告不会把这三个「除非」写出来。哔哩哔哩 数字不必然造假,但缺前提的数字不可比,这是读所有H3实测的第一原则;
AMD路线(Ryzen AI MAX+ 395核显+128G统一内存,纯HIP单文件h3-hip.c):第一条快速视频端到端约95秒,但15秒长片约45分钟(耗时随时序token超线性增长),模型上限362帧,首次加载权重约107GiB,优化后NVMe读取成了新的固定成本。它的谱系很有意思——Redis作者antirez给Mac手写了h3.c,Alex He把GPU后端换成HIP才有了这条纯A卡路。作者的态度也诚实:没有蒸馏,没有微调,没有降精度换分数。知乎 潜台词是加速空间还没换完。
一句话收拢这张表:8-12G显存的「流畅」,和24G+64G内存的「能干活」,买的是两件事;而所有档位跑出来的,都只是768p的H3-Base。


第三笔账:0.7个月回本是怎么算崩的
发这条测算的小红书博主「Token经济猫」自己就把它否了,原话很干脆:数学没错,但算的不是官方那件货——这是笔假账。小红书 我把崩点用上面已有的数字拆给你看(纯按公开口径估算):
要在21天回本36600元,得每天替掉约1743元云端账单。按2K云端0.8元/秒算——这是社区盘点给出的口径,0.8元/秒是同梯队闭源旗舰的三分之一左右——那么每天要替掉约2179秒成片,36分钟2K日产量。知乎
第一崩:本地H3-Base到顶768p,而2K那一步按官方README的玩法,是把768p连同上下文喂回模型重生成一遍——不是你能自托管的轻量超分,这部分没开源、在云上。你产出的每一分钟想达到账单里那个「2K价」,还得回云端续费,本地省的云账,一半被Regenerate-2K和Context-IR收了回去。
第二崩:就算只算768p,按消费级实测最快的24倍速(还是来自引流帖的那条5080数据),24小时不眠不休日产也就60分钟成片,再扣掉抽卡废片、改提示词、复核、渲染,真实日产量撑死十几分钟。0.7个月回本的前提,是把这台机器当成24×7且永不出废片的代工厂。
第三崩:云端价格不是常量。首发促销口径有「2K 0.2元/秒起」,社区也有口碑价——海螺h3闲时3分钱(这条只有一个出处,不做依据,留着看价格战走向)。小红书 云端每降一次价,本地回本账的分母就重写一次。
换句话说,「存为王」的本地党真正的收益从来不是躲账单——微博用户「小敌鸽」在开源当天那句点评才是本体:硬件要求高,但是可以无限试错了。微博 对天天抽卡的漫剧玩家,本地把试错成本从每分钟48元(2K价折算)打成了电费,这才是该买的理由;把它当成理财来算回本,才是被0.7个月话术带进沟里的开始。


结论:谁现在可以上车,谁别急,盯什么
现在就值得动手的两种人:
手里已有24G+显存、64G+内存和NVMe,月产量大、工作流以「抽卡-改-再抽」为主的内容生产者——你买的是试错免费,4090博主那套「多段复用不卸载+每段前/free」的调度经验直接抄;
AMD平台玩家:盯h3-hip.c和它背后的单文件路线,短片段已经可用,长片还得等优化。
继续等的三种人:
8G-12G显卡用户:ClipProj换编码器方案(4B/8B编码器替掉15.7GB的32B,显存降到4.5-8.3GB)是目前最像样的入口。知乎 但作者自己给它定性——目前属于概念验证性质,效果可用,但并非官方正式方案,画质与32B还有细微差距,等它沉淀;
需要2K成片的商用团队:Regenerate-2K和Context-IR绕不开,你的正确姿势是「云端出片+本地抽卡」的混合流,而不是买整机;
被「一键整合包」引流帖种草的小白:先把你那台机器的显存、内存、硬盘三围量清楚,再回头看广告缺了哪些前提。
继续盯三个信号。第一,官方会不会补发上下文模块或授权其蒸馏。第二,9月4日刚进社区的加速线VDN-Minimax-H3,能不能把小显存档位的实际帧数打下来,届时「8G门票」会被重新定价。哔哩哔哩 第三,fal那套3秒生成720p 5秒视频的H3Max至今没开源。知乎 忻致知在知乎的追问代表了社区的大半情绪——过几天同类型方案从开源社区的地里长出来了怎么办?知乎 这条开源/闭源赛跑的战线,比任何一张整合包都更决定你明年要不要换卡。
最后重申一遍这笔账单的第一行:看到「本地部署H3」五个字,先问它跑的是不是那个H3。