LTX-2.5 开源视频模型:单卡 RTX 5090 本地运行,瑕疵率评测十款模型登顶

LTX-2.5 开源视频模型:单卡 RTX 5090 本地运行,瑕疵率评测十款模型登顶

视频生成模型的开源阵营再添一员。LTX(Lightricks 旗下的视频 AI 品牌)发布了 LTX-2.5 视频生成基础模型,22B 参数,权重、训练代码和推理管线全部开放下载。单张 RTX 5090 即可本地部署,最低 16GB 显存即可运行。年收入低于 1000 万美元可免费商用,不强制品牌标注。

LTX-2.5 多镜头场景演示

瑕疵率评测:98 个提示词,十款模型横向对比

官方用同一组 98 个提示词,对十款主流视频生成模型做了文生视频瑕疵率评测。评分方式是自动化检测,统计每段视频中的色斑(blotches)、纹理破碎(broken texture)和画面融化/拖影(melted or smeared areas)。分数越低越好。

模型瑕疵分数(越低越好)
LTX 2.5 Pro0.28
LTX 2.5 Fast0.39
Flux 30.45
MiniMax H30.46
Wan 2.60.65
Seedance 2.50.69
LTX 2.3 Pro(前代)0.74
Kling 3 Pro0.76
Seedance 2.00.60
Veo 3.11.20

LTX 2.5 Pro 以 0.28 的分数排名第一,前代 LTX 2.3 Pro 为 0.74,改进幅度明显。Veo 3.1 以 1.20 垫底。官方注明此为初步评测结果,预计会随评测范围扩展而更新。

速度对比:生成 10 秒视频耗时

LTX-2.5 画面流畅度演示

模型10 秒视频生成耗时
LTX 2.5 本地部署6.8 秒
LTX 2.5 API23.7 秒
Omni Flash52 秒
Grok 1.563 秒
Veo 3.170 秒
MiniMax H3180 秒
Seedance 2.0196 秒
FLUX 3259 秒
Seedance 2.5317 秒
Kling 3.0 Pro398 秒

本地部署测试环境为 2× GB200 GPU,720p 分辨率,24fps,LTX 以 6.8 秒生成 10 秒视频,快于实时。API 模式在第三方平台 fal.run 上测试,包含排队时间。

各模型渲染分辨率存在差异:Omni Flash、Grok 1.5、Veo 3.1、Seedance 2.0 和 FLUX 3 渲染为 720p;Seedance 2.5 最高 720p;MiniMax H3 渲染为 768p;Kling 3.0 Pro 约 1080p。LTX API 在 1080p 下测试(LTX 无 720p 档位),在更高分辨率下仍是最快。

架构改进:扩散解码器与文本编码器

LTX-2.5 提示词遵循演示

LTX-2.5 的核心架构改动集中在三个方面:

扩散视频解码器(Diffusion Fidelity Rendering):新一代视频解码器,按场景复杂度动态分配渲染计算资源。官方描述其能在逐帧层面保持像素质量,即使在影院屏幕上也经得起放大。

Gemma 4 12B 文本编码器:搭配自研提示词增强器(prompt enhancer),模型对复杂创作指令的理解能力提升。用户可以用更短、更简单的提示词获得准确的结果。

原生多镜头连贯:支持在一个生成任务中创建多个镜头,角色形象、环境光照和声音在镜头切换间保持一致。这一点对叙事性视频创作有实际意义。

此外还加入了自动时长预测(根据提示词描述的动作自动决定片段长度)、原生 4K HDR 输出、RAW 工作流(直接接入 DaVinci 等专业调色管线),以及预训练基础模型 checkpoint 供用户在自有数据上 fine-tune。

许可证与开源生态

LTX-2.5 采用开放式权重许可证。核心条款:

  • 年收入低于 1000 万美元免费商用
  • 不强制品牌标注(对比 MiniMax H3 要求显示 "MinMax H3" 字样)
  • 管辖法律适用美国法律
  • 支持在任意 GPU 品牌上运行(对比部分竞品仅限 CUDA 或 4 GPU 配置)

模型权重、训练代码、推理管线、评测基准均已开放:

  • GitHub:github.com/Lightricks/LTX-2
  • HuggingFace:huggingface.co/Lightricks/LTX-2.3(约 2800 万下载)
  • 文档:docs.ltx.video

官方同时提供 API 服务,按生成视频时长计费:720p 每秒 0.09 美元,1080p 每秒 0.15 美元,2K 每秒 0.19 美元,4K 每秒 0.37 美元。

社区已围绕 LTX 构建了 ComfyUI 工作流和 LoRA 生态,包括说话头像(AV LoRA)、绿幕头像、FPV 无人机运镜、音频驱动生成等。LTX Desktop 桌面端应用支持 Windows/Linux NVIDIA GPU 本地运行。

与竞品的开放性对比

LTX 在官方对比表中强调了几个差异化点:

能力LTX 2.5MiniMax H3Seedance 2.5Kling 3.0 ProVeo 3.1Grok 1.5
开放权重完整开放部分开放否(Closed API)
管辖法律美国中国中国中国美国
最低显存16GB~115GB(4 GPU)
部署方式本地+边缘+API自托管+API仅 API仅 API仅 API仅 API

来源:LTX 官网 · 开源页面