Lightricks的LTX-2.5输给MiniMax H3的开场,却找到了自己的真正位置:H3负责生成,LTX-2.5负责放大

源自18位全网作者

14:50

8月12日,Lightricks开源LTX-2.5。两周过去,社区情绪走出了一条有意思的曲线。

发布当天,刷屏的是"6.8秒生成10秒视频"的速度神话;两周后,B站热度最高的对比视频评论区,高赞留言变成了"以前还是小甜甜,现在已经是牛夫人了"。哔哩哔哩理由不复杂:LTX-2.5的首帧生成画质,打不过早两天开源的MiniMax H3,连官方对比表都在被社区集中吐槽口径问题后火速下线。知乎有UP主干脆把视频标题写成"到下午就没有人玩了吗"。

但把时间线再往后翻,是另一个故事:玩家们没有让这对"对手"继续对打,而是把它们装进了同一条流水线。整个8月,"H3生成+LTX-2.5放大"的混合工作流在B站密集出现,其中一条二采放大工作流视频攒下362个收藏。被嫌弃的LTX-2.5,悄悄回到了很多人的显卡里。

为什么是组合,而不是二选一

H3的生成质量是开源第一梯队,但高分辨率下又慢又吃配置。有UP主在实测中的描述很直接:目前h3模型跑高分辨率视频非常慢而且对电脑要求非常高,同时原生其实并不支持跑2K视频会出问题,所以想到用LTX进行放大。哔哩哔哩

LTX-2.5正好相反:首帧生成画质平平、复杂动作容易崩,但它提供固定8步推理的Distilled蒸馏权重,速度快、显存门槛低,8GB显存的卡配量化权重也能跑。知乎而且它这一代新增的扩散视频解码器,就是针对传统解码流程在人脸、屏显文字、高运动场景容易出现伪影的问题,在解码阶段用一个轻量扩散模型做精修——天生适合干"精修"的活。知乎

Lightricks的LTX-2.5输给MiniMax H3的开场,却找到了自己的真正位置:H3负责生成,LTX-2.5负责放大

所以社区的解很朴素:H3负责"生成得对",LTX-2.5负责"看得清"。有评论区的总结很直白:要是有wan的画质,H3的逻辑,和LTX的速度,三合一就完美了!!!哔哩哔哩既然等不到三合一,那就先拼起来。

跑通的混合路线,目前主要三条

路线一:H3低分辨率抽卡+LTX-2.5二采放大。先用480p批量生成挑片,选中后再用LTX放大。8月初就有人实测:10秒视频,H3跑480p约230秒,LTX-2.3放大到720p约240秒,总计不到500秒——比直接高分辨率抽卡省得多。哔哩哔哩

路线二:H3生成+LTX-2.5 MSR二采。这是最近讨论度最高的组合,有UP主实测:使用LTX-2.5 MSR对MiniMax H3生成的视频进行二采放大,显存占用更低、速度更快,相比用H3自己做二次采样快约30%,相同显存下放大倍数更大、能直出2K。哔哩哔哩需要说明,这是单一UP主的测试数据,不是官方口径,但方向与多条独立工作流一致。

路线三:给LTX-2.5加专用增强LoRA。社区已经出现专门面向高清放大的增强LoRA,比如魔搭社区上架的LTX-2.5-CQ-Video-and-Image-Enhancer-LoRAs。哔哩哔哩由于LTX-2.5与2.3同架构,2.3时代积累的LoRA资产大多能直接沿用。知乎这是LTX在生态上的存量优势,风格化的生成内容也能靠这些资产持续迭代。

Lightricks的LTX-2.5输给MiniMax H3的开场,却找到了自己的真正位置:H3负责生成,LTX-2.5负责放大

不同显存不同玩法

  • 8GB(如RTX 4060):能跑。社区已有4步二采方案,但要把虚拟内存拉到64GB,速度别期待太高,适合先试水。哔哩哔哩

  • 12-16GB:舒适区。最近发布的分块采样器能把二采显存占用压到最低9GB,16GB显存即可跑通双BF16模型的二采放大工作流。哔哩哔哩

  • 24GB(如RTX 4090):比较从容,但BF16全精度权重依然装不下,需要量化或offload,建议直接用ComfyUI对应的量化工作流。知乎

  • 没有显卡:云平台有现成的H3+LTX-2.5混合工作流可直接体验。

还有一个容易被忽略的成本:磁盘。LTX-2.5的权重、文本编码器、VAE加起来几十GB,部署攻略普遍建议预留100GB硬盘、64GB内存起步。知乎双模型玩家的空间规划要趁早。

三个坑,社区已经替你踩过了

第一,二采救不了废片。放大的上限由首帧决定,LTX二采修的是"糊",不是"错"——构图崩了、肢体错了,放大只会得到一张更清晰的废片。

第二,中文提示词偏弱。官方称新版Gemma 4文本编码器支持英、德、西、法、日、韩、中、意、葡9种语言。知乎但社区实测的反馈不太一样,有用户吐槽:厉害,主要h3还支持中文,ltx中文都是乱码。哔哩哔哩写提示词建议还是用英文。

第三,"放大位"未必稳固。H3自家的潜空间放大方案在快速迭代,已有工作流宣称二采直出2K、质量高于SeedVR2等VAE放大方式。哔哩哔哩社区还流传"h3缺一个超分放大模块,官方承诺了很快会开源"的消息(未获官方确认)。哔哩哔哩一旦落地,LTX-2.5的"放大窗口"可能被压缩。

写在最后

两周前,社区还在争论LTX-2.5配不配有一席之地;两周后,玩家们用工作流给出了答案:开源模型之间未必是你死我活,更现实的玩法是分工——质量交给H3,速度和放大交给LTX-2.5,短板留给下一个版本去补。

Lightricks的LTX-2.5输给MiniMax H3的开场,却找到了自己的真正位置:H3负责生成,LTX-2.5负责放大

已经装了H3的,不必急着删LTX-2.5,把它放到放大位;还没上车的,先对照上面的显存分档表检查配置。接下来值得持续盯两个信号:H3官方高清放大模块是否落地,以及传闻中"在路上"的LTX-3。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章