MiniMax H3开源34天,全网实测档位终于拼齐:8G能不能跑看架构,二手V100是最容易踩的坑

源自210位全网作者

04:56

8月3日MiniMax H3开源那天,本地AI圈的说法还是"视频自由了,可以无限试错"。微博一个月过去,评论区的高频问题变成了另一批:“我12G的卡会不会爆”“收张二手V100算不算捡漏”“跑5秒480P到底要等多久”。

情绪期结束,该看实测了。我把这一个月知乎、B站、微博上能找到的部署记录拼成一张表——同一个镜头,不同显卡的差距比你想象的大得多,而且有一个反直觉的结论先放在这里:显存容量决定它能不能跑,架构决定它跑多快,你的内存条决定它跑得顺不顺。捡便宜收V100,是三件事里最容易只对上第一件的做法。

一张全网实测档位表:先对号入座

统一口径尽量取同一测试者的同一工作流:ComfyUI官方默认工作流、480P(864×480)5秒文生视频,社区流通的多模态文件集合约39.5GB。知乎

你的配置

5秒480P成片耗时

实测来源口径

RTX 4080 SUPER 32G

约2分半

9月3日知乎同轮对比

RTX 5060 Ti 16G

约5分钟;此前还能顶到1920×1088的5秒成片

9月3日知乎同轮对比

RTX 3060 12G(INT8裁剪版)

约8分钟

9月4日知乎部署实测

Tesla V100 32G(上一代数据中心卡)

约19分半(峰值显存25G、内存56G)

9月3日知乎实测

Tesla V100 16G

约20分钟(峰值显存反而只有约10G)

同上

8G显存档

第三方整合包宣称"6G内存+8G显存也能玩、10秒约450秒",无标准复现

8月7日B站整合包视频,4200+条评论争议

5090 + FastH3/H3Max生态版

秒级:官方口径10.1秒成片8.7秒渲染、5秒视频不到3秒

9月1-2日,注意这是云侧/后训练版本

两个数字值得停下来看:一是 16G显存居然没爆——V100 16G跑完整个流程峰值只吃了约10G,因为大模型会自动把层卸载到内存,代价是内存峰值高达56GB。知乎 如果你的16G显卡配的是16G内存条,H3这扇门根本没开,卸载空间都不够。二是5090那些"3秒出片"的消息,来自fal和FastVideo基于开源权重做的后训练加速版(H3Max、FastH3),后者已经能做到3秒生成5秒720P视频、渲染速度首次跑赢播放。知乎目前它们主要跑在云上,不是装进你机箱的东西——但它预示了接下来半年本地生态会白捡的速度红利。真要上手,第一步是装ComfyUI Desktop:装完它会自己检测你的GPU类型和硬盘空间,本地部署的门槛有多高,第一眼先看这张检测界面。

MiniMax H3开源34天,全网实测档位终于拼齐:8G能不能跑看架构,二手V100是最容易踩的坑

为什么32G的V100,跑不过16G的5060 Ti

这是这个月最有教学意义的一组数据。V100显存大一倍,生成同一条5秒视频反而慢接近4倍。原因就一句话:H3的社区流通量化版走的是NVFP4低精度路线,RTX 50系(Blackwell)硬件级支持FP4运算,V100的Volta架构压根不是给这种负载设计的知乎

这直接改写了"什么卡能玩视频生成"的判断标准。过去两年本地部署圈攒下的共识——“显存不够,二手数据中心卡来凑,V100/3090魔改真香”——在LLM聊天上依然部分成立(大显存跑大模型推理没毛病),但在视频生成上是失效的:视频扩散模型的算力和低精度格式支持,老卡架构补不出来。同一篇实测的结论写得很直白:专门为了AI视频生成去买V100,现在已经不太推荐了。

顺带一提,ComfyUI 0.33.0给老卡加了"LoRA 8步采样加速",但实测发现这个优化只在V100这类老架构上触发,4080S和5060Ti都没有,官方口径就是"这个优化主要是针对相对老旧的显卡"。知乎 别把它理解成"升级ComfyUI全员提速",那台"再次提速350%"的整合包视频,说的也就是这类老卡专属路径。哔哩哔哩

H3真正的显存门卫,其实不是主模型

很多8G、12G用户装不上,卡住的不是视频模型本体,而是H3工作流里那个负责"翻译"提示词的文本编码器——Qwen3-VL-32B,一进来就吃掉15.7GB显存,主模型还没开工房间已经住满。知乎

9月4日刚被圈子里传开的ComfyUI-ClipProj插件,做法是拿共用同一分词器的4B/8B小编码器+几百兆的投影矩阵,把32B"翻译官"换掉:bf16档占8.3G、fp8档5.2G、int8档最低4.5G,编码器开销直接砍掉三分之二,释放的显存留给扩散模型本体。这就是"8G能跑"从吹牛变成可操作的路径。但要按作者自己的口径泼盆冷水:这还是个概念验证性质的非官方方案,版本迭代很频繁(建议0.1.4起装),画质有细微损耗,复杂多镜头提示词与32B原版仍有差距。

这个月真正变硬的两个事实

热闹归热闹,值不值得投入,看这两条:

  1. 官方许可条款第一次可以逐字读了。H3的开源权重走的不是MIT那种"随便造",而是《MiniMax H3社区许可协议》(2026年8月2日生效):完整权重开放、明确支持微调和LoRA训练;商用免费,但有三道硬杠——年营收超过2000万美元的公司需要另行向MiniMax申请授权;商用产品界面必须显著标注"MiniMax H3";许可证适用地区明确排除美国、欧盟、英国和韩国。魔搭社区外加一条最有时代特征的"防蒸馏"条款——不许拿H3的生成结果去训练行为相似的其他模型。对个人和国内中小工作室,这套条款基本等于"接单自由",但两条执行细节要提前做进交付流程:界面署名,以及不要接欧美客户。8月29日ComfyUI官方又补了一条代理通道:通过Comfy可获取H3本地商用授权,完整商用权利、生成内容归你、可用于客户项目。微博以前"本地跑开源"和"商用交付"中间隔着一层授权灰雾,现在这两条通道一内一外,把它扫清了大半。

  2. 开源第一次真正摸到了闭源旗舰的天花板。DesignArena多图生视频专项测试里,Seedance 2.5 Elo 1400、H3 1355——差距在缩小而非反超。微博微博上那篇"闭源商业大闭环被硬生生切开一个口子"的说法是情绪,1355对1400才是账:为这个差距立刻迁移全家工作流,还不成立。微博但"开源追平是时间问题"这个预期,已经足够影响你现在买什么卡。

顺手把官方口径的能力上限也钉住,省得你按上一代模型的想象做预期:输出4-15秒、24FPS、原生32kHz立体声、默认短边768、2K要靠H3-Regenerate-2K补——整条链路是"输入理解→768P生成→高分辨率重生成"三段,官方README里的系统总览图就是这条流水线。

MiniMax H3开源34天,全网实测档位终于拼齐:8G能不能跑看架构,二手V100是最容易踩的坑

全参考模式(Ref2VA)最多吃9张图+3段视频+3段音频、合计不超过12个输入文件——"全能参考"是真实存在的功能,不是营销词。官方架构图显示,H3-Base本体是"文本/视觉/音频编码→DiT扩散主干→VAE解码"的多模块结构,其中文本编码器就是那颗Qwen3-VL-32B——这也解释了为什么显存那一段能被人动刀。

MiniMax H3开源34天,全网实测档位终于拼齐:8G能不能跑看架构,二手V100是最容易踩的坑

接着算钱:积分黑洞、卡时租卡和买卡

云端这条线:H3发布时官方定价砍到同类约三分之一。微博首发渠道2K画质也要0.2元/秒起,768P更是便宜一半。哔哩哔哩fal的H3MAX页面明码写着480P $0.0125/秒、768P $0.02/秒。知乎但接一张角色/风格参考图,输出价可能跳到$0.08/秒、四倍于裸价——这是账单上最容易被看错的一行。

云端真正的成本还不在这里。B站那期"我烧了一万多积分才摸清H3什么水平"(4400+赞)之所以炸出864条评论,是因为所有做过成片的人都有同一个体感:一个能交付的镜头背后是十几条废片,试错本身就是生产成本——按次计费的模式下,你付的钱大部分买了"过程"。哔哩哔哩

本地这条线,工作室侧9月3日有人把账摊开(测算示例口径):按量租专业版RTX 4090约2.08元/卡时。知乎每天集中生产8小时、一个月30天,约500元/月,先验证一套自己的H3+ComfyUI环境;3-4人团队要解决"人在工作、GPU在排队",8张4090的月成本到4000元量级——此时买到的不是单条提速,而是并发。

所以决策其实分三段,跟"本地方不方便"关系不大:偶尔出片,老实按次买云,参考图模式的四倍溢价记得看清;已经开始每天跑素材,先租卡跑通工作流再谈买卡,把部署维护时间也计进成本;只有当你确认要长期占用一张卡,买卡才进入选项——而且按上面的架构结论,预算要留给支持FP4的新卡,而不是省进二手老卡。

整合包、破限版和云盘链接:这周的现场有多乱

热度变现的速度比模型下载快。现在B站搜"H3本地部署",前排一半是"三连+关注、评论掉落夸克网盘"的整合包,从"最低8G显存流畅跑"到"提速1050%“什么口径都有;还有蹭Seedance名义的"破限版”"无限生成"教程。哔哩哔哩给三条硬提醒:

  • 整合包最大的风险不是慢,是版本黑盒:你不知道里面的量化档、编码器替换方案是哪一个,跑出来的画质没法和公开复现的记录对齐,商用交付时更是没法向客户解释成片链路。

  • "提速XX%"类标题优先怀疑触发条件:这个月的实锤是8步采样优化只在老架构生效,新架构卡装整合包大概率买的是个心理安慰。

  • 涉及"破限""无审核"字样的,交付即风险,平台侧和内容侧的雷都得你自己扛。

  • 顺带的市场背景:连40HX这类被解锁算力的老卡都在涨价(9月5日B站硬件区讨论),H3带动的显存需求正在外溢到二手市场,"再等等就跌"这个剧本最近不一定按LLM那轮的节奏走。哔哩哔哩

对照一下官方路线长什么样:ComfyUI Desktop走正规流程时,模型清单是摊开在眼前的——diffusion主干、VAE、text_encoders、LoRA各归各位、逐个下载,版本和来源一目了然。这才是该固化的工作流基线。

MiniMax H3开源34天,全网实测档位终于拼齐:8G能不能跑看架构,二手V100是最容易踩的坑

谁该现在动手,谁该再等等

  • 手里是50/40系16G以上、本来就在出片的:值得本地跑起来。商用授权链路已在补齐,NVFP4新架构跑得动,先用官方Comfy模板把工作流固化,别急着上第三方包。

  • 8G-12G显卡、想把H3当玩具入门的:可以玩,走ClipProj+INT8这条已被复现的路,把预期钉死在480P、单条几分钟——它是"看懂H3能力边界"的窗口,不是生产力。同时先看你内存条够不够16G,再谈显存。

  • 在算"收张V100/老计算卡捡漏"的:这一篇的实测表就是劝退贴。能跑不等于好用,20分钟一条480P省下的卡钱,会用加班还回去。

  • Seedance的重度用户:1355对1400,还没到迁移的理由;但"开源追平"叠加H3Max/FastH3把云侧速度卷过实时线,按量API的价格只会往下压,按量付费的你反而该观望。

  • 给工作室做预算的:别问"要不要上8卡",先量自己一天重跑多少条废片。按次买云和按卡时租本地没有谁更好,分界线就是你的重跑频率——这也是这笔账里唯一不变的算法。

值得继续盯的三个信号:Comfy那纸本地商用授权会不会扩散成行业默认动作;H3Max/FastH3这条生态加速线什么时候下沉到消费级本地;以及MiniMax下一次开权重,还会不会像8月3日这样,把"要不要本地部署"这个问题直接砸到你显卡脸上。

内容由AI生成

精选参考来源

1. 【MiniMaxH3正式开源】财联社8月3日电,MiniMaxH3模型正式开源。华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Inte

2. MiniMax H3 16g显存能跑吗?

3. 302.AI基准实验室|MiniMaxH3Max实测:10秒渲染一条口播视频,AI视频迎来自己的Flash时刻

4. 8G显存【MiniMaxH3】一键整合包,再次提速350%|8G显存10秒只需450秒!6g内存+8g显存也能玩MinimaxH3+加速高达45%!

5. 显存直降10G!小显卡也能本地跑MiniMaxH3视频模型

6. MiniMax H3 Community License Agreement

7. MiniMaxH3已以开源权重发布,发布当天即可在ComfyUI中使用。768P视频加原生立体声,在3060这样的显卡上就能本地运行。现在通过Comfy即可获取

8. DesignArena发布的多图生视频专项测试排行:-BytePlus(字节跳动)Seedance2.5,Elo评分1400-MiniMax开源模型MiniMa

9. 字节要是上市公司,这两天股票应该是要一字大暴跌的。闭源Seedance2.5被开源的MiniMaxH3追平了,买字节API生成视频,发在字节App,投放在字节,

10. #MiniMaxH3价格仅为同类三分之一# 【大模型“价格战”烧向多模态?MiniMax推出新一代多模态生成模型,定价降至行业同类模型三分之一】7月31日,Mi

11. 小孩哥拯救充气城堡!MiniMaxH3首发上线,2K画质0.2元/秒起,全站热门模型同享最低29折!

12. MiniMaxH3MAX:为什么接一张参考图,价格会从0.02美元/秒变成0.08美元/秒?

13. 我烧了一万多积分,终于摸清H3是个什么水平|AI视频大测评

14. AIGC工作室最烧钱的不是生成,而是反复重跑:为什么我开始考虑84090跑MiniMaxH3

15. 九月视频生成真神!Seedance2.5破限版!本地部署,视频无限生成,这波开源直接封神!Stability.AI!(附安装包)

16. 40HX被解锁算力和pcie!涨价的风又来了

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章