H3开源六周,战场从"装不装得上"挪到"熬不熬得过":返工成本、修复工具、交付上限,三条新线同时变了

源自113位全网作者

02:41

小红书那篇"4张图搞定MiniMax H3本地部署"的笔记下面,最尖的一条评论不是求整合包,是一句"4张图能部署不等于能稳定出片;把12GB/4070这类卡的峰值显存、连续5段生成的失败率和重跑时间晒出来,才知道本地省的是钱还是把返工转给自己"。小红书

这条评论问出的,正是铺设期结束后没人接着算的问题。H3于8月3日正式开源,华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等芯片厂商以及HuggingFace等社区和云推理平台同日完成适配。 从正式开源那天起,“显存门票拆到了几G”“五件套34GB下哪个版本”“一条15秒要等多久”,这些账社区已经替大家排过好几轮,结论大同小异:入门便宜,出片抽卡,返工才是大头。微博

H3开源六周,战场从

但最近两周,重心明显挪了。没人再讨论装不装得上,开始讨论熬不熬得过:Turbo LoRA和FastH3在管速度,视频局部重绘在管修复,“75折创作台”"提示词画廊"则踩着开源的肩膀开始收钱。三条新线几乎同时变化,每一条都有要先掰清的坑。

速度线:省的不是等待,是返工的价格

先把口径混着的速度数字摆开——都来自社区帖,各有各的机器档位,别拿去对号错位:

  • 原生节点、RTX 5060 Ti 16GB:图生视频5秒约3分钟(–novram全卸载路线,作者原话"能用但不算快");

  • SageAttention + EasyCache加速节点、RTX 4090级:15秒视频从约8分钟压到约4分钟,网友反馈画质有轻微下降;

  • H3 Turbo LoRA(4-8步)+ Tiny AutoEncoder预览覆盖(8月12日放出):关键不在步数少,在"早停"——预览不对就停掉,改提示词或换种子,不用等满8分钟才发现废了;

  • FastVideo的FastH3、Fal.ai的H3Max这类二次训练变体(8月31日前后被刷起来):有博主拿5090实测"5秒视频3秒生成,提速确实明显",网上已经出现了AI视频无限流直播。

前两条是"出一条片子"的速度,后两条是"抽十次卡"的速度,适用场景完全不同:Turbo四步够预演分镜、验构图;要发布的那条成片,还是全步数再跑一次。EasyCache的画质损耗,预演无所谓,成片别开。把这条线算成一句话:加速档位省的电费可以忽略,省的是"等满8分钟才知道是废卡"这笔钱。

H3开源六周,战场从

修复线:从"整段重roll"到"哪坏了修哪"

9月8日,MiniMax H3的视频局部重绘(inpainting)模块放出:可点选、可提示、可手动画遮罩,ComfyUI和Diffusers两条路都通,HF Space上直接可玩。 它的意义不在"又多了个功能",在工作流从此变了:以前手部穿模、文字糊了、表情抽风,只能整段重roll、重新抽签;现在坏哪遮哪、局部重绘。配上FastH3或Turbo,形成一套低成本闭环——快速整段roll粗剪,inpainting修单点,最后只把定稿的交付升画质。微博

顺手一条铁律也是社区实测排的雷:出片宽高必须是32的倍数,768×448、832×480能跑,768×432、704×400直接报错。出片失败有时候不是模型的锅,是像素数的锅。

交付线:混合格式第一次变成一笔可算的账

修复和加速都在768P圈子里打转,天花板没动过:三模块系统里开源的只有中间的H3-Base,负责提示词理解的H3-Context-IR(官方说对最终画质影响很大)和把768P重生成为2K的H3-Regenerate-2K都在云端,官方说法是后面会单独开源、现在只能用API,这个"后补"仍是承诺。 本地能修,修不出2K;中文口播依旧弱,声音多半还得自己接TTS补。知乎

H3开源六周,战场从

于是"本地跑粗剪、API付尾款"的混合路线,从口号变成了可算的账。云端锚点:官方API的报价被教程直接写进对照表——想最快出片,直接调官方API,0.8元/秒出2K。 有博主晒过LibTV活动价768P一毛一秒、2K两毛,不到Seedance 2.0(一块五一秒)的一半。 H3发布时的口号本身是"定价降到同类三分之一"。具体下单前以平台实时价目为准。知乎微博

硬件端,今天站内词条在售价:七彩虹RTX 5090D 10399元(旗舰店页面价11899元)、耕升RTX 5080 12199元、华硕RTX 5060 2999元、京东海外自营RTX 5090 43999元——给offload用的大内存同样没便宜,芝奇DDR5 6000在售价3199元。

H3开源六周,战场从

按两毛一秒的活动价粗算,每天预演一小时素材,一个月省下约360元;一张1.2万档的卡,光靠预演回本要摊三十个月上下。更要命的是这条账把最大成本藏在了"省的钱"里:5060 Ti原生5秒要3分钟,所谓"预演一小时",意味着机器整天在转、人也整天陪着。混合路线只适合两种人:挂得后台夜以继日抽卡的,和返工率高到把修复做成日常的。

生态线:白嫖模型养出来的收费圈子和水军帖

9月13日的微博上,已经能看到"H3提示词画廊"和"辉光版SD2.5创作台(75折)“的广告;B站整合包卖家、知乎"白嫖AI视频"式引流贴同样密集。围绕免费开源模型长出一层付费生态不意外,要顺带掰清的是,对比帖也开始下场了:8月底那篇《为什么我们弃用本地MiniMax H3》,同底图同提示词横测三家,结论吹向一个来路不明的"牛马战神”——全文没有机器档位、没有参数、没有失败率,只有情绪词。

鉴别这轮帖子,三个问题够用:给没给可复现的参数?跑在什么档位机器上?最后卖不卖东西?三问里至少答上一问,才有参考价值。另有一条不是硬件的坑:H3的社区许可把美国、欧盟、英国、韩国用户排除在直接使用权重之外,需要单独拿授权,国内开发者不受影响。 做出海交付的,商用协议细读一遍再动手。知乎

最后对号入座

  • 还没装上的:先把显存和五件套那本旧账读完再决定。门槛确实降过——ComfyUI-ClipProj插件用4B编码器换掉15.7GB的32B文本编码器,int8量化模式最低可以压到4.5GB,8G卡门开了一半。 但它是社区PoC性质、不是官方方案,版本迭代频繁,要装装0.1.4以上。知乎

  • 装了正在被返工折磨的:先别花钱升级显卡,把Turbo预览早停和inpainting装上,这一对是为你准备的;每天预演量撑得起的,再考虑FastH3这类变体。

  • 稳定出片的生产队:按"本地粗剪+云端2K"混着算,拿本月交付秒数乘价目,对一下显卡折旧和你的工时,再决定加卡还是加预算。

值得继续盯的信号就三个:H3-Regenerate-2K的开源排期、稀疏注意力什么时候补进开源版、ClipProj会不会被收编成正式方案。这三个任何一个动了,上面这本账都得重算一遍。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章