MiniMax H3 Max 来了:5 秒视频不到 3 秒出片
fal 发布 H3 Max——一个基于 MiniMax H3 的后训练加速版视频模型。核心数字只有一个:一段 5 秒的 720p 视频,不到 3 秒就能生成完,比你看完它还要快。社区里有人把它称为 AI 视频的「Stable Diffusion 1.5 时刻」。

先分清两个名字
这个模型的名字容易让人误会,先捋清楚:
MiniMax H3:MiniMax 官方 7 月底开源的开放权重全模态视频模型,Hailuo 2.3 的继任者。输出最高 2K、每段生成自带原生立体声音频、支持图像/视频/音频多重参考,5 到 15 秒。
H3 Max:不是 MiniMax 官方发布。它是 fal Research 在 H3 开放权重基础上做的后训练版本,8 月 27 日由 fal 推出,只在 fal 平台提供服务。
fal 做了两件事:一是用大量新数据对模型后训练,重点提升提示词遵循和视觉质量;二是推理团队把模型和自家服务栈联合优化——模型还在训练时,推理方案就同步设计,跑在 NVIDIA GB200 NVL72 系统上。
为什么这么快
fal 给出的速度数据:5 秒 768p 视频生成不到 3 秒(实测约 2.5 秒),约为官方 MiniMax H3 endpoint 吞吐量的 35 倍,平均比同等质量模型快 15 倍。Design Arena 的独立测试口径更激进,说超过 50 倍。
代价是分辨率。H3 Max 输出上限是 768p(1344×768、24FPS),480p 可选——基础 H3 能出的 2K 在它这里没有了。fal 的取舍很明确:为"大量快速出片、够社交平台用"的场景优化,而不是追求电影级输出。此外它砍掉了基础 H3 的多参考工作流,只保留文生视频(T2V)、图生视频(I2V)和可选末帧条件,音频则保留原生同步。
质量:自评第一,第三方也第一
fal 说 H3 Max 在 12 个领先视频模型的 head-to-head 人类偏好测试里(用贝叶斯 Elo 评分),整体质量、提示词理解、美学三项全部第一——对手包括官方 H3 endpoint、Gemini Omni Flash、Wan 3.0、Seedance 2.5、Kling 3、Veo 3.1。第三方评测里,Artificial Analysis 和 Design Arena 也给了它第一。
老实说,这些数字要打个折扣看:速度倍数和偏好排名都是 fal 自报的,第三方排名虽然方向一致,但独立复现还没跟上。可以理解为"方向可信,具体数字等验证"。
价格与免费档
fal 定价:768p 约 0.08 美元/秒(约 4.8 美元/分钟),发布前 14 天半价。
免费档:不注册每天 5 次 5 秒 768p 生成;登录后每天再送 5 次(每次最长 15 秒)。
生态接入:Krea 已把 H3 Max 放进视频工具(Krea 计划 9 美元/月起,含免费每日额度);Hermes Agent v0.20.6 也把它列为视频模型选项。
社区反应:一天之内就玩出花
开放权重 + 加速模型的组合,让社区反应速度惊人:
FastVideo 团队发布 FastH3 V1(4 步稀疏蒸馏版),Blackwell GPU 上最高 14 倍加速,单张 B200 生成 15 秒 768p 视频约 47 秒,4 张 B200 接近实时。
独立开发者开源 X-MinimaxH3,用自动调度稀疏注意力,让单张 RTX 4090 跑原生 720p→1440p 两阶段采样——5/10/15 秒视频分别只要 112/223/334 秒。消费级显卡跑 1440p,这是之前不敢想的。
Ethan Mollick 实测后说:网页端生成一段质量合理的视频,耗时已经比观看它更短。
总结
H3 Max 的意义不在"又一个更快的视频模型",而在于把生成速度和播放速度的临界点跨过去了。之前 AI 视频是"批量工具"——生成一分钟,看你一分钟;现在它开始变成"实时媒介"——可以交互、可以持续流式输出(实时直播方向的进展,我们另文再聊)。这对做内容的人意味着工作流要重写:先用 H3 Max 快速迭代 prompt(5 秒一次,一分钟能试 10 个方向),锁定方向后再用 2K 级模型出最终成品。
对做 prompt 的人来说还有个更实际的信号:H3 Max 后训练的核心就是"提示词遵循",也就是说,同样的描述,H3 Max 会比基础版更听话。这可能是它除了速度之外,对你我这类重度用 prompt 的人最有用的一点。
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

张大妈
校验提示文案
张大妈
校验提示文案