LTX-2.5生成10秒视频只要6.8秒,但那是两张GB200的成绩:想在本地部署,先对一下显存档位

源自16位全网作者

10:14

这周AI视频开源圈是真的热闹。8月11日,开放世界模型公司LTX扔了一颗炸弹——LTX-2.5正式发布知乎。用一位小红书博主的话说,AI视频生成领域的开源圈有点狂喜:MiniMax H3刚刚开放权重,Lightricks又开源发布了小红书

有人欢喜有人愁。有博主吐槽,自己熬夜刚把MiniMaxH3部署完做测试,结果一看LTX2.5就开源了,这卷的有点夸张啊小红书。B站评论区已经开始玩梗:LTX,别见面了,我怕H3误会哔哩哔哩

LTX-2.5生成10秒视频只要6.8秒,但那是两张GB200的成绩:想在本地部署,先对一下显存档位

6.8秒是“极速档”,不是你的成绩

让这次发布刷屏的数字是:在2张英伟达GB200芯片的自托管配置下,生成10秒720P视频仅需6.8秒,比视频播放本身还快知乎小红书。但这个数字别直接代入自己的电脑:它是把延迟压到极致的“极速档”,靠蒸馏减少去噪步数、NVFP4减少显存和带宽占用、顶级硬件把通信延迟压到最低,证明的是这条路线的上限,不是入门门槛知乎

旧卡连入场都要打折:原生FP4只有Blackwell架构支持,Ampere/Hopper旧卡会退化成模拟,收益打折知乎。更接近消费级的参考是:有人用5090D跑1080p、10秒的视频,耗时不到170秒小红书。同一个模型,从6.8秒到170秒,差的主要不是技术,是那两张GB200。

想在本地跑,先对显存档位

先搞清楚体量:LTX-2.5是22B参数的双流架构,视频流14B、音频流5B,加文本投影约3B知乎

24GB显存(RTX 3090/4090这一档)是讨论最多的档位。完整BF16不适合按24GB单卡路径直接加载,得走量化、CPU offload或专用ComfyUI工作流知乎。量化版的体积友好不少,INT8量化能把权重体积直接砍半,从42GB压到21.5GB知乎

LTX-2.5生成10秒视频只要6.8秒,但那是两张GB200的成绩:想在本地部署,先对一下显存档位

显存之外还有两笔账:内存建议64GB起步,offload场景预留96GB到128GB,硬盘至少预留100GB知乎

软件环境也有门槛:官方建议Python 3.12、CUDA 12.7及以上、PyTorch 2.7左右,日志还停在Python 3.11并遇到兼容问题的,先升级Python知乎

12GB显存的卡也不是完全没戏。有用户在B站整合包视频下问3060 12G显存能不能跑,得到的回复是:可以,内存不低于32GB就可以,设置一下虚拟内存哔哩哔哩。这个档位拼的是内存和耐心,适合先体验流程,不适合当生产力。

至于标题写着“8G显存就能跑”的整合包,确实存在哔哩哔哩。但这类方案通常靠更激进的量化和更重的offload换来低门槛,能跑起来和好用是两回事,尝鲜可以,别对速度和画质抱太高期待。

LTX-2.5生成10秒视频只要6.8秒,但那是两张GB200的成绩:想在本地部署,先对一下显存档位

画质:别拿蒸馏版对标完整版

这一代画质的核心升级在解码端:LTX-2.5用新的扩散视频解码器替换了此前的VAE重建阶段,重点改善人脸、纹理、画面文字和运动中的可见瑕疵知乎

但要提醒一句:传播最广的速度数据都来自蒸馏版,而蒸馏版在主体和动作上接近完整版约90%–95%,极细的手部、微文字会略软知乎。拿蒸馏版的速度脑补完整版的画质,是这波讨论里最常见的误读。

和H3比谁强?社区还没吵明白

目前社区没有共识,因为两拨人比的根本不是一件事。有整合包作者给自己的包打分很直白:和海螺H3比还是个弟弟哔哩哔哩。也有实测党觉得LTX2.5的提示词遵循比MiniMaxH3要好一些,生成尺寸也更大小红书。还有一派盯着宣传战,吐槽ltx2.5上线后的第一件事不是展现自己的实力,而是迫不及待在宣传上给H3扣帽子和断章取义知乎

LTX-2.5生成10秒视频只要6.8秒,但那是两张GB200的成绩:想在本地部署,先对一下显存档位

我的判断:这俩走的不是同一条路。H3适合追画质上限、做长视频的人;LTX-2.5的优势在快、开源、商用友好,适合要快速迭代、做数字人和短视频流水线的人。与其纠结谁更强,不如先想清楚自己最在意哪一项。

抛开跑分:这次真正给齐了什么

比起跑分,更值得看的是LTX这次把东西给齐了:蒸馏模型、量化方案全部开放,还提供更易修改的预训练权重和更宽松的授权协议哔哩哔哩

音画同步是另一个硬菜:它不生成哑视频,单次能生成最长20秒的同步音视频内容,原生支持4K、50fps知乎。最直接的受益场景是数字人,已经有整合包把LTX2.5搭配Gemma4做出嘴型微表情精准同步的效果,也有人直接判断LTX2.5的最佳应用就是数字人哔哩哔哩哔哩哔哩

生产级功能也补齐了:相比LTX-2.3,LTX-2.5新增原生多镜头、自动时长预测知乎。B站已经有人基于它搭出全栈式短剧工作流,迭代到了V24.1哔哩哔哩

有作者总结得挺准:视频生成的叙事在悄悄换挡,早期追问“能不能生成”,现在追问的是“能不能在可控成本里稳定交付”知乎

谁适合现在动手

最后给个分档建议:

  • 24GB显存+64GB内存:可以认真玩,INT8量化+offload是当前主流路径,建议从ComfyUI工作流或整合包上手;

  • 12GB显存+32GB内存:能跑,靠虚拟内存兜底,适合体验流程,不适合量产;

  • 8GB及以下:建议先看别人跑或者云端体验,别为一条整合包标题冲动买卡。

也别只盯着LTX-2.5。开源视频这条线还会继续卷,目前已经有MiniMax H3,FLUX3也即将开源小红书。评论区还有一堆人在等H3的长视频功能哔哩哔哩。硬件已经到位的,现在就可以找整合包上手;还在观望硬件的,建议等几轮消费级显卡实测横评再决定。

内容由AI生成

精选参考来源

1. LTX-2.5杀入战局:10秒720P视频仅需6.8秒,AI视频从“泡杯咖啡”进入“秒级时代”

2. 10 秒视频 6.8 秒出,但 LTX-2.5 真正的杀手锏不是快

3. LTX-2.5 22B 本地部署:ModelScope 下载、8 步推理与图生视频命令

4. LTX-2.5 开源:22B 音画生成模型,原生多镜头、自动时长与 4K HDR

5. AI 模型 LTX-2.5 仅 6.8 秒生成 10 秒 720p 视频,会带来哪些改变?

6. LTX2.5多模态视频生成webUI整合包(v1.0 和海螺H3比还是个弟弟!)-小进步!但是还是感谢LTX团队开源!

7. AI视频新天花板!LTX2.5一键整合包搭配Gemma4,嘴型微表情精准同步,小白也能做影视级大片!

8. 【AIGC实战课 142】LTX2.5 的最佳应用居然是数字人

9. LTX-2.5发布:全球共建的世界模型再升级

10. 碾压MiniMaxH3?LTX2.5全新整合包强势来袭!8G显存就能跑的全能AI视频神器!

11. 牛夫人!!!LTX2.5全栈式短剧工作流V24.1

12. LTX-2.5开源,生成比播放还快——10秒视频

13. LTX2.5开源,熬夜熬了个寂寞

14. LTX2.5开源了,而且这个榜单太搞笑了

15. LTX2.5 跟 MiniMaxH3 全都要?

16. LTX 2.5 视频模型开源!视频开源生态爆发!

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章