9月底,B站一个标题就叫"同一条AI视频,Seedance100块,本地8毛钱?2026年,入门AI视频的第一道选择题:云,还是本地部署?“的横评视频跑了54万播放、近6000个点赞。评论区两极分化:“seedance这么贵啊,我的天”,和"不是普通人能烧的起的”。哔哩哔哩
背景是MiniMax H3开放权重带来的第一个"算总账月"。7月31日H3发布、开放权重进入官方仓库,该仓自8月13日起没有新增文件。到9月底,社区量化档、整合包、租卡平台和一键镜像全部就位,连整合包作者都开始拿"8GB加速600%"(UP主自测口径)当卖点揽客。和文本模型的玩具局不同,这波摸到的是短剧、口播带货、营销片的真实产线——涉及的钱也是真的:16G的显卡,已经被行情带得涨价。知乎哔哩哔哩

第一笔账:云API,按秒定价已经公开可比
先把最容易混淆的一条摆正:流传的"2K视频成本不到主流三分之一"是官方API口径,不是你家主机的——2K与24FPS仍只在API侧,本地H3-Base的分辨率上限是768p,官方模板明确16:9满血档就是1344x768。知乎
云端的账,现在按秒就能算。聚合站Higgsfield把H3标为768p每秒0.074美元、2K每秒0.126美元;PoYo的H3 Max Turbo标为480p每秒0.025、768p 0.040、1080p每秒0.080美元;Atlas Cloud把H3做成四档、起价每秒0.038美元。折算下来,一条15秒的768p素材在1.1美元上下。官方平台始终不公布调用量和单价,但"生成一条几十块"是错觉——云端真正的成本大头从来不是单价,是抽卡倍数。B站横评视频里"100块一条成片"的账,本质是"多次抽卡+会员摊薄"的账。知乎哔哩哔哩
适合谁:月产不超过10条、必须要2K或24fps、要直接商用交付的。商用这条要特别提一句:ComfyUI官方文档明写,本地生成的视频要商用需要MiniMax商业授权,而Comfy自称"唯一的官方转售方"——云端正规订阅反而是把商用权利打包买走。知乎
第二笔账:租卡,反直觉结论最多的一张桌
知乎有位作者做了本月最有信息量的一组对照:3090、4080 Super 32G(魔改版)、4090三张卡在算力平台租来跑官方INT8模型,两个分辨率、九组数据,只看速度4090全面胜出、没有悬念——0.9MP任务耗时约为3090的37%~39%,0.4MP约为43%~44%。但把账摊开,结论会掉头:知乎
计费按小时不按条数,摊到每条视频,成本结论是"3090 >> 4080S > 4090"——单卡租金最便宜的3090反而最贵,4090最低,慢本身就是最大的成本项。知乎
三类任务里r2v(参考素材生视频)在三张卡上稳定最快,这个顺序在三张卡、两个分辨率上高度一致;第一次运行普遍比第二三次慢几十秒(模型加载、显存分配、CUDA初始化),看数据要看稳定轮次。
Turbo模式(官方多挂一个LoRA压缩采样步数)实测提速2~3倍,但画质打折、显存消耗反而上升、OOM概率变高——作者因此统一把系统内存配到64G,“不是显存,是内存,但内存不够同样会在高负载时拖累稳定性”。
租卡行情参照:AutoDL租一张RTX4090(24GB),约2元/小时。那位实测作者的收尾建议也是本轮社区共识里最清醒的一句:租一小时的成本,远低于选错卡之后返工的成本。知乎知乎

适合谁:想学ComfyUI工作流、产量不稳、还在"我的卡到底跑不跑得动"阶段的人。评论区流传的三步路值得抄:先用聚合平台闭源模型傻瓜式操作找手感,再租云主机跑别人做好的工作流出东西体验,最后才轮到本地部署整合包。哔哩哔哩
第三笔账:装机,门票涨得比教程快
官方org下托管的集成索引页(awesome-minimax-h3-integration)把"多少显存配哪套栈"做成了可查表。这等于官方侧默认了消费级必须靠社区量化才能跑的现实,常被引用的档位建议是:知乎
24GB:首跑推荐19.53GB的pruned INT8加14.61GB量化编码器;
22GB老Turing卡:有专门W4A8组合,自报基线每条5.7分钟,配块缓存降43%,八步采样加块缓存压到210秒;
12~16GB:走pruned Q4_K_M或nvfp4;
8GB:DiffSynth的NF4路径,索引页原话是"主要是卸载到内存、慢不是省显存";
Mac用户:Redis作者antirez的h3.c被索引页列为Apple Silicon方案,MIT许可、2781星,但目前没有第三方复现。知乎
然后是时间账。中文社区自报:4060笔记本8G显存+16G内存直出720p 15秒,耗时35分钟;8G档10秒约450秒;1920x1088有人从一小时优化到17分钟——全部是单人单次体验,能证明这些档位在被人使用,不能证明可用。更早的ComfyUI整合包时代,微博就有"用本地部署跑这个44秒视频,花了差不多一天才完成抽卡剪辑"的吐槽——本地省钱的前提,是你耗得起抽卡的时间。知乎微博

最后是门票。这波行情对装机党很不友好:7月起显存因AI算力需求全线涨价,8G的涨600、12G的涨900、16G的涨1200,之前2499的5060 8G涨到了3099。H3发布当晚,就有知乎作者晒出京东页面感叹"16g显存的显卡已经被带飞了"。再往上,RTX5090被炒到2.8万+,华强北的5080一天一个价干到12000元、商户连固定报价单都不敢出。"免费"的模型,把装机的门票抬进了涨价区间。微博知乎微博

别踩的三个坑
“开源"不等于"随便商用”。 权重仓用的仍是MiniMax H3 Community License,承诺的Apache-2.0迁移至今没有落地记录,美国欧盟英国韩国的授权门槛与两千万美元营收门槛照旧。接单之前把授权条款读一遍,比看十个教程有用。知乎
多人素材短剧别急着本地化。 H3的招牌是原生立体声、音画一次生成,但负责理解多素材关系的H3-Context-IR是闭源的,B站评论区提醒:多数H3效果展示都只敢搞少量参考素材,“短剧常见的3人物+3音色+1-2道具+1场景的直接崩”。漫剧教程里"单日一部剧、成本降为0"的标题,当广告看就好。哔哩哔哩
27.7倍提速不是你的。 8月流传的"MiniMax H3获英伟达Sol Engine大幅加速",实测环境是单张GB200、10秒768p从414秒降到14.93秒——数据中心口径,和家用机没关系。微博
至于成片质量本身,别信单边吹:arXiv预印本的世界模型评测把H3与万象、Seedance 2.5、可灵等放同一榜单,H3在参考生视频组与万象并列第一,但同一测试里"孔径小于球就不能穿过"的物理常识题上,H3与几个云端头部模型一样让球穿过了挡板。知乎
继续盯什么
判断这波值不值得上车,盯四个信号:官方权重仓是否落地Apache-2.0、是否新增量化与2K链路;框架层的提速兑现度——ComfyUI官方账号称H3视频VAE编码提速约2.2倍、1344x768编解码往返从24.3秒降到12.7秒。 H3-Context-IR等闭源模块是否开放,这决定短剧工作流的本地天花板;以及16G显卡的价格曲线——"开源"把单条成片的边际成本打到了毛级,也把门票打到了涨价区,盯盘本身就是决策的一部分。知乎
三年前Stable Diffusion爆火的时候,“之前6g生图貌似也能玩玩”;到了视频时代,同一位用户的结论变成了"现在视频6g好像边都沾不上了"。开源红利是真的,算力门票也是真的——三笔账各有各的适合人群,抄作业之前,先把自己的产量、分辨率要求和商用需求,填进对应的那张表格里。哔哩哔哩