9月12日往前数48小时,B站的"本地部署"几乎被一个名字刷屏:MiniMax H3。秋叶的ComfyUI整合包更新到,包标题直接写着"兼容minimaxh3本地部署"。零度解说也发了保姆级教程,4600+播放、45条评论。满屏标题是"8G显存也能玩"“6G显卡玩转4K”“无限时长免费生成”。哔哩哔哩哔哩哔哩
蠢蠢欲动的,很多是刚在4060、5060上折腾完27B量化、跑通了聊天模型的那批人:既然LLM能本地"token自由",视频是不是也能搬回家?知乎
但注意一个细节:H3是8月3日开源权重的,教程潮却拖到9月中旬才爆——评论区那句"炒冷饭?这都发布一个多月了",恰好点破了这轮行情的真相:能不能上车,从来不由权重决定,由工具链决定。而标题不会告诉你的,是三个数:66GB、40分钟、一张商用许可。哔哩哔哩
先给结论:这波是真的,但"跑得动"和"能出片"之间,隔着不止一张显卡。
一、三个数,先把上头浇凉
第一个数:66GB——第一道门不是显存,是硬盘和内存条。
小红书9月11日有人逐项拆过包:一个INT8加速主模型文件就约21GB,某实验权重库列出的总文件约66.4GB,工作流、VAE另算。更常被忽略的是系统内存:所谓"8G显存跑通"的公开案例,配置是8G显存+64G内存跑768p、15秒——显存不够,内存来凑,这是llama.cpp那套offload思路在视频上的翻版。B站评论区立刻有对照实验失败预定:“4060,8g显存,16g内存笔记本能用吗”。那位跑通8G的博主自己踩过并写明了:虚拟内存是硬盘当内存,跟显存两回事,OOM了唯一的出路是降分辨率。小红书小红书哔哩哔哩
所以装之前,看两处:盘上有没有100GB余量,内存有没有64GB。只盯显卡的,第一步就下不完文件。

第二个数:40分钟——"无限试错"的真实上限。
目前公开实测里,单片耗时的三个独立样本是同一量级:128G统一内存(给GPU分了96G)的铭凡主机,768p/5秒/Turbo 4步约43分钟,Base 50步要4小时20分。5060Ti 16G+16G内存的用户报告,480p/15秒要1小时。9月11日微博上还有位3090Ti 24G+192G内存的高配用户直接吐槽"本地部署H3生成1080的视频,快50分钟了还没完"。三台机器、三种配置,单片都落在几十分钟量级,公开样本里至今没有更快的。小红书哔哩哔哩微博
对照一下标题党:B站有"5秒视频3秒生成""3060一次生成40秒视频"的说法,而Comfy官方对H3的描述是单次时长5到15秒、最高2K。一次生成40秒,本身就超出了官方规格,要么是多段拼接,要么标题在赌你没跑过。小红书
算笔账:一台卡"无限免费"出片的理论上限,是24小时除以40分钟,约36条5秒素材——前提是你接受夜里排队、白天来收货盘,而且每条都"能看"。做漫剧、分镜这种结构化批量活,这个产能有意义;想"随手一条发着玩",等40分钟的挫败感会让你第一周就回去买额度。
第三个数:一张商业许可——“下载了≠能商用”。
9月11-12日连续两篇小红书都在强调:ComfyUI Desktop本身GPL-3.0免费,但H3权重页是自己的社区许可证,Comfy官方页面写明本地商用需要另取H3商业许可。同时能力边界也划清了:H3-Base的本地路线主要面向768p音视频,官方2K重生成目前仍走API。“本地跑通=整套能力免费搬回家+接单自由”,是目前这轮教程潮里最贵的误会。小红书小红书
二、"8G跑得动"背后的前置条件,每一条都是成本
流传最广的8G跑通案例,是RTX 5060笔记本、8G显存、全程本地出片23秒的国风短片。但把条件逐项摊开,你会发现标题只说了十分之一:小红书
必须用lightx2v/Minimax-h3-Turbo这套LoRA加速,4步采样,且强度必须1.0——调到0直接LoRA失效、画面崩坏;
768p模板起步,近方形参考图还得改中心裁切,不然"把人裁没了";
RTX 50系驱动要580+,573有玄学问题;
运镜写dolly-in不理你,只管微动,推拉得后期逐帧缩放补;
同一模型在16G(4060Ti)上的更早实测(8月5日)给的提醒是:pruned+int8能跑,但中文口播不稳定,建议分离配音。小红书
评论区也能看到同向的碎片:有人"上半身没问题,下半身开始畸形",有人"提示词好难写,自己写的效果都一般"。这些不是黑,是4步蒸馏+低分辨率这条"能跑"路线的真实画质和稳定性水位。哔哩哔哩

所以正确的读法是:“8G跑得动"的"跑”,指的是"能打开",不是"能出这个画质"。这和LLM圈"下载塞得下权重"和"日常用得爽"是两回事——只是战场从KV cache换成了采样步数和硬盘。
三、为什么开源一个月后才爆:看懂这个,你就知道下一个该什么时候上车
把时间线排开,节奏非常清楚:
7月31日:MiniMax发布H3——每经从官方确认这是MiniMax首款开源多模态生成模型,官宣视频生成定价0.8元/秒(2K),仅为业内同类旗舰的三分之一,单次最高15s、原生双声道,同时预告开源。微博
8月3日:权重放出,社区当天开始对照闭源的Seedance(坊间流通价约1.5元/秒),"不亚于一秒一块五的Seedance但能无限试错"成为第一波讨论。微博
8月12日:H3Turbo LoRA(4-8步蒸馏)+ TinyAutoEncoder快速预览出现,才把"等几分钟看废片"的循环变成可用的迭代流。微博
8月15日:edge-dit.cpp加入支持,24G档跑通。小红书
9月8日:视频局部重绘(inpainting)模块开源,能点选/画遮罩改局部。微博
9月11-12日:秋叶整合包官宣兼容、主流教程UP下场——装机门槛被整合包抹平,教程潮爆发。哔哩哔哩
从权重开源到普通人"解压即用",走了40天。这就是开源视频模型的标准节奏:权重只是发令枪,量化版、步数蒸馏、快速预览、局部重绘、整合包,一样到位才轮到你的显卡。
这条规律立刻有用:9月12日刚开源的LTX 2.5宣称最低8G显存生成5秒视频、AMD已有人首发跑通。正处在周期的第1周。现在冲进去当小白鼠,和8月初硬啃H3原始权重一样,会非常疼。哔哩哔哩
四、谁上车,谁等,谁别碰
按你手里的设备和用途对号,比看任何教程都重要:
现在就可以装的:
16G+显存、64G+内存,做漫剧/分镜/素材工厂这类"结构化批量"内容,接受夜间排队的——连那篇128G实测自己下的结论都是:本地适合跑批量、结构化内容,核心精品仍用第一梯队闭源。人家把边界替你画好了。

素材不能出机器、或有内容明确不想过公开审核的——微博上"消费级机器部署、无需审核"被反复当卖点。成立,但代价是合规、质量、纠纷全部自担。微博
再等一等的:
8G显存+16G内存的笔记本党:offload路线要内存撑腰,你这配置大概率连文件都加载不利索;
需要2K交付的:本地路线现阶段主打768p,2K重生成还在API那头;
打算直接接单的:商业许可没谈下来之前,先别把本地出片写进报价单。
别碰的:
“关注私信自动获取”“8月份int8和现在有什么区别吗,GGUF的网盘呢”“NSFW破限制整合包”“破线版”——这些关键词凑在一起,基本就是来路无法验证的改包权重+来源不明的插件+随时失效的网盘三件套。你装进去的不只是模型,还有一整条没人背书的供应链。想快,云端API按次付费反而干净。哔哩哔哩
五、电表和账单:这轮到底省没省钱
本地出片的电费几乎可以忽略——一台主机满负荷跑一小时,按民用电价折算就是几毛钱级别。真正的成本是显存占用×等待时间×返工耐心。
算笔账:一条5秒视频,云端官方牌价0.8元/秒(2K档,每经记者7月31日从官方拿到的数字),一次生成4元。;本地一条电费几分到几毛,但机器时间40分钟起。本地赢在第20次迭代:改提示词、换参考图、反复挑刺这种"筛选型"工作流,边际成本归零;云端是每次调用掏钱。所以那句话可以当判据——你是在"生成",还是在"筛选"?生成一条就走,云端;筛选一百条留下三条,本地才划算。微博

最后留个互动:这轮H3本地潮里,你卡在哪一步——盘不够、内存不够、等不起40分钟,还是被"私信领取"的整合包坑过?评论区报个配置,看看哪种人是真上车了、哪种是被标题上的车。