"6G显存能跑"和"3090Ti没优势"同时在刷屏:H3部署潮里,出片党先把这三道门槛算清

源自36位全网作者

02:12

开源权重放出来才一个多月,“本地跑视频模型"突然从极客玩具变成了教程区刷屏——9月12日到13日两天,B站集中冒出一批H3本地部署教程,点赞最高的那条标题直接写着"8G显存运行N-S-FW=Minmaxh3,比Flash-Next更适合本地部署保姆级使用教程 6G显存可用 附整合包 新手友好 AI视频创作福音!”,171个赞、114个收藏。 小红书上545赞的教程号称"无论是否有显卡都可以部署"。 同一时间,一位3090Ti+192G内存的用户发帖问"生成好慢啊",评论区泼来冷水——“CPU毫无关系的,原生开源默认20步肯定慢的,还有各种加速节点,而且你3090ti在H3没任何优势”。 而另一边,有人晒自己的4080S出条5秒视频只要"几分钟"。哔哩哔哩小红书小红书

这些数字没有一个是假的——它们只是各自对着一道不同的门槛。对手里攥着8G到24G消费级显卡、想把短片从"买积分"改成"本地跑"的出片党来说,装整合包之前,得先把三道门槛算清:容量、速度、成本。

第一道门槛:容量账——“能启动”“能出片”"官方交付"是三个门

先拆"多大"这件事。H3被二手解读反复引用的标签是"33B视频模型",但33B只是核心去噪网络H3-Omni-Transformer:把 32B 的 Qwen3-VL 编码器和两套 VAE 全算上,完整推理栈其实在 65B 量级。知乎

反过来也成立:33B 里约 13B 属于可预计算缓存的 AdaLN 分支,纯推理时根本不加载,去噪循环真正常驻的权重只有约 20B。 这套数字出自一篇按Hugging Face模型卡和仓库config.json逐项核对的拆解,作者凡是模型卡没写、由自己推的都明标"推断"——比大多数标题视频靠谱。知乎

更要命的是"能出多大"。按模型卡的交付口径,H3输出4到15秒、24FPS、32kHz立体声——画面、对白、音效、配乐联合生成,这是它和上一代视频模型最实在的差异;但短边默认 768 像素;2K 需经 H3-Regenerate-2K(未开源)。 也就是说,本地部署的画质上限从第一天起就是"768p+自己想办法超分"。小红书上那篇收藏44的部署笔记把话挑明了——“H3-Base的本地路线主要面向768p音视频;官方2K重生成目前仍涉及API,不能把"可以本地跑"理解成整套能力都免费搬回家”。知乎小红书

那"6G显存可用"到底是什么?是量化版、显存卸载、四步八步加速LoRA、出完再超分这一整套组合拳打完之后的结果——就连这些加速件本身,也是社区补的课:MiniMax H3 生成模型的轻量化高速生成 LoRA 已公开,在社区中引发热议,“尺寸缩小至五分之一,能节省 VRAM 的特点广受好评”。 教程标题不算骗人,但那是"能动"的门槛,不是官方交付口径。微博

给想下载的人两条实在提醒。第一,官方权重在Hugging Face和魔搭都免费下载——拿AMD 395小主机跑H3的玩家写得很直白——“用的是Comfy-Org/MiniMax-H3这个版本的模型,可以到魔搭社区免费下载,工作流可到ComfyUI官网下载”。 第二,“6G可用"教程的评论区33条几乎全是"三连啦,麻烦up了"配自动回复的"私信掉落”,UP主粉丝162个、视频带着AI生成内容声明——卖料包那套玩法,已经从聊天社区复制到出片社区了。 另外别只盯显卡,显存、系统内存、磁盘要三件一起查:有4070Ti+128G DDR4用户跑完就给结论——“目前结论是瓶颈是hbm,12g太小了”。知乎哔哩哔哩小红书

第二道门槛:速度账:同一条视频差20倍,全是真的

过去两周,知乎、B站、小红书、微博评论区里用户自报的实测数据拼起来,大概是这样(均为自报、口径混杂,没经过统一复测,看趋势别看单条):

平台/显卡

自报口径

时长

等待

普通台式机

默认工作流、768p、无加速

7秒

30分钟

同一台台式机

挂四步加速LoRA

7秒

约5分钟

4080S

加速口径

5秒

几分钟

5070Ti 16G+96G内存

BF16+2个加速节点+8步LoRA、0.9MP

15秒

900秒内

16G显存+32G内存

15秒、8步LoRA

15秒

半小时内

4070+64G

2MP高像素、偏原生

12秒

1900+秒

3060

0.4MP降像素

13秒

约10分钟(跟评口径)

3090Ti 24G+192G

想跑1080P

“太慢”,被评"H3没优势"

表里最大的落差发生在同一台机器上:默认工作流渲染一个7s的768p视频要30min,但加了个加速lora,渲染时间直接压缩到5min,关键是还能保证渲染质量。 再往下拆,决定速度的是四个变量:步数与加速LoRA、像素量(0.4MP和2MP差出好几倍)、精度与卸载方式、分辨率(老老实实768p加超分,还是硬上1080p)。显存容量反而是最次要的那个——24G的3090Ti输给16G的5070Ti,输的是带宽和步数口径,不是门牌上的那个G。微博

另一端的玩法叫挂机:漫剧玩家把H3接进全自动工作流,“无抽卡AI全自动出片,挂机20多个小时全AI设计,一帧未剪”。 也有Mac Studio M3Ultra用户把本地千问、H3与FFmpeg串成流水线,六段素材自动组接出31秒初版,挂一晚出片。哔哩哔哩哔哩哔哩

所以"XX分钟一条"这种数字,没带口径就没有可比性——这跟当年文本圈Ollama跑分吵成一锅粥是同一个病根。抄作业前,先确认对面那台机器跟你的卡、你的内存、你要的分辨率是不是同一档。

第三道门槛:成本账:本地部署不是省钱,是跟"抽卡次数"对赌

先把云端的价摆清楚:即梦会员价约0.24元/秒,更高画质档位Seedance 2.0 Fast约0.56-0.6元/秒,MiniMax H3 API约0.6元/秒、5秒768p约3元——一分钟成片就是36元档。 MiniMax在7月31日发布H3时,打的就是"定价降至行业同类模型三分之一"这张牌。 这个价格本身,就是对"要不要本地"最直接的回应。知乎微博

本地这边:电费几乎可以忽略,真正花的是时间。加速口径好,5分钟一条;口径差,半小时一条,还整台机器占着。而AI视频最真实的成本是"抽卡"——同一条提示词,跑废是常态。云端废一条是3块钱,本地废一条是半小时起步。

算笔粗账(基于上面口径自建模型,只用于判断量级):一个月出20条短片、平均每条抽卡3次、每次5秒,云端约180元。想靠"本地免费"省回这笔钱,代价是专门为H3换一张卡?怎么算都回不来。反过来,三种情形下本地部署真的值:一是漫剧、批量口播这种要一次挂机跑几十条的量产党,“抽卡不心疼"是刚需;二是企业素材、未发布产品这类不能过别人服务器数据的;三是ComfyUI管线已经跑顺、要把H3插进现有流程锁角色做参考生视频的——Ref2VA最多能吃"图像 ≤9 张、视频 ≤3 段、音频 ≤3 段,文件总数 ≤12”,这套控制力才是云端积分买不到的东西。知乎

至于教程里各种"免费"——Kaggle双T4的帖子标题就写着"真正实现免费无限生成MiniMax-H3!Kaggle双T4保姆级推理教程",那是租Google的排队算力;云加速平台同理。当体验通道可以,当长期饭票不行。 还有一条被反复转发的提醒值得记住——“涉及商业交付,还要核对许可要求,不能默认下载了权重就能免费商用”。知乎小红书

三类人,三条路

月产不超过三五条、纯玩票的:别装。API加网页版比768p本地超分便宜、快,2K能力只在云端。省下的折腾时间够你多写十条提示词。

手里有16G显存以上、内存不拉胯、本来就玩ComfyUI、需要反复试镜头:可以装。从魔搭或HF拉Comfy-Org官方版本,BF16起步,配社区四步/八步加速LoRA,先跑通一条768p带对白带音效的完整片子,再考虑加参考图、上首尾帧控制。别一上来就拉满参数。

8G、12G显存的:先别为它升级显卡,也别急着重装系统。你现在的"能跑"是别人的组合拳,不是你的。先用云端把题材跑对——如果H3的音画一体生成根本不适合你的内容,装什么都没用。

接下来值得盯的信号:H3-Regenerate-2K会不会跟进开源;官方最低配置的正式口径会不会修订;轻量化LoRA还能把步数压到几;魔搭版和HF版的更新同步速度。


口径说明:模型参数与能力边界以Hugging Face模型卡(经参考来源4逐字段核对)为据;速度数据为用户自报,样本来自B站、小红书、知乎、微博2026年9月7日至13日的公开帖子与评论,未经统一环境复测;API价格为公开评测与讨论帖口径,非官方价目页实时数据,下单前以官网为准。

内容由AI生成

精选参考来源

1. 8G显存运行N-S-FW=Minmaxh3,比Flash-Next更适合本地部署保姆级使用教程 6G显存可用 附整合包 新手友好 AI视频创作福音!

2. 本地部署开源视频模型 AI视频从此不花钱

3. 大佬们,H3本地部署生成好慢啊

4. 深度解析 MiniMax H3:一段视频怎么从 3.72 亿个噪声数值里"长"出来

5. MiniMax H3本地部署,值吗?

6. MiniMax H3 生成模型的轻量化高速生成 LoRA 已公开,在社区中引发热议。尺寸缩小至五分之一,能节省 VRAM 的特点广受好评。比较验证中也被认为与原版画质无差异,欢迎轻量化的声音此起彼伏。#MiniMaxH3 #ComfyUI 网页链接

7. AMD Ryzen AI Max+ 395主机跑MiniMax-H3文生视频模型

8. 本地部署H3测试

9. minimaxH3复活了我台式机上的ComfyUI台式机性能一般,默认工作流渲染一个7s的768p视频要30min但加了个加速lora,渲染时间直接压缩到5min关键是还能保证渲染质量,基本上满足自用需求我用的加速Lora是Kijai的MiniMax-H3的四步加速Lora

10. 因的出现,在每个人的身上,是固定的,而果的降临。对每个人。都是随机的。

11. Mac Studio本地部署Qwen接上本地部署H3,能给自己出片么?

12. 如何评价AI视频生成的价格下探?0.1元/秒的H3模型是什么水平?

13. #MiniMaxH3价格仅为同类三分之一# 【大模型"价格战"烧向多模态?MiniMax推出新一代多模态生成模型,定价降至行业同类模型三分之一】

14. 真正实现免费无限生成MiniMax-H3!Kaggle双T4保姆级推理教程

1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章