LTX-2.5 开源视频模型:单卡 RTX 5090 本地运行,瑕疵率评测十款模型登顶
视频生成模型的开源阵营再添一员。LTX(Lightricks 旗下的视频 AI 品牌)发布了 LTX-2.5 视频生成基础模型,22B 参数,权重、训练代码和推理管线全部开放下载。单张 RTX 5090 即可本地部署,最低 16GB 显存即可运行。年收入低于 1000 万美元可免费商用,不强制品牌标注。

瑕疵率评测:98 个提示词,十款模型横向对比
官方用同一组 98 个提示词,对十款主流视频生成模型做了文生视频瑕疵率评测。评分方式是自动化检测,统计每段视频中的色斑(blotches)、纹理破碎(broken texture)和画面融化/拖影(melted or smeared areas)。分数越低越好。
| 模型 | 瑕疵分数(越低越好) |
|---|---|
| LTX 2.5 Pro | 0.28 |
| LTX 2.5 Fast | 0.39 |
| Flux 3 | 0.45 |
| MiniMax H3 | 0.46 |
| Wan 2.6 | 0.65 |
| Seedance 2.5 | 0.69 |
| LTX 2.3 Pro(前代) | 0.74 |
| Kling 3 Pro | 0.76 |
| Seedance 2.0 | 0.60 |
| Veo 3.1 | 1.20 |
LTX 2.5 Pro 以 0.28 的分数排名第一,前代 LTX 2.3 Pro 为 0.74,改进幅度明显。Veo 3.1 以 1.20 垫底。官方注明此为初步评测结果,预计会随评测范围扩展而更新。
速度对比:生成 10 秒视频耗时

| 模型 | 10 秒视频生成耗时 |
|---|---|
| LTX 2.5 本地部署 | 6.8 秒 |
| LTX 2.5 API | 23.7 秒 |
| Omni Flash | 52 秒 |
| Grok 1.5 | 63 秒 |
| Veo 3.1 | 70 秒 |
| MiniMax H3 | 180 秒 |
| Seedance 2.0 | 196 秒 |
| FLUX 3 | 259 秒 |
| Seedance 2.5 | 317 秒 |
| Kling 3.0 Pro | 398 秒 |
本地部署测试环境为 2× GB200 GPU,720p 分辨率,24fps,LTX 以 6.8 秒生成 10 秒视频,快于实时。API 模式在第三方平台 fal.run 上测试,包含排队时间。
各模型渲染分辨率存在差异:Omni Flash、Grok 1.5、Veo 3.1、Seedance 2.0 和 FLUX 3 渲染为 720p;Seedance 2.5 最高 720p;MiniMax H3 渲染为 768p;Kling 3.0 Pro 约 1080p。LTX API 在 1080p 下测试(LTX 无 720p 档位),在更高分辨率下仍是最快。
架构改进:扩散解码器与文本编码器

LTX-2.5 的核心架构改动集中在三个方面:
扩散视频解码器(Diffusion Fidelity Rendering):新一代视频解码器,按场景复杂度动态分配渲染计算资源。官方描述其能在逐帧层面保持像素质量,即使在影院屏幕上也经得起放大。
Gemma 4 12B 文本编码器:搭配自研提示词增强器(prompt enhancer),模型对复杂创作指令的理解能力提升。用户可以用更短、更简单的提示词获得准确的结果。
原生多镜头连贯:支持在一个生成任务中创建多个镜头,角色形象、环境光照和声音在镜头切换间保持一致。这一点对叙事性视频创作有实际意义。
此外还加入了自动时长预测(根据提示词描述的动作自动决定片段长度)、原生 4K HDR 输出、RAW 工作流(直接接入 DaVinci 等专业调色管线),以及预训练基础模型 checkpoint 供用户在自有数据上 fine-tune。
许可证与开源生态
LTX-2.5 采用开放式权重许可证。核心条款:
- 年收入低于 1000 万美元免费商用
- 不强制品牌标注(对比 MiniMax H3 要求显示 "MinMax H3" 字样)
- 管辖法律适用美国法律
- 支持在任意 GPU 品牌上运行(对比部分竞品仅限 CUDA 或 4 GPU 配置)
模型权重、训练代码、推理管线、评测基准均已开放:
- GitHub:github.com/Lightricks/LTX-2
- HuggingFace:huggingface.co/Lightricks/LTX-2.3(约 2800 万下载)
- 文档:docs.ltx.video
官方同时提供 API 服务,按生成视频时长计费:720p 每秒 0.09 美元,1080p 每秒 0.15 美元,2K 每秒 0.19 美元,4K 每秒 0.37 美元。
社区已围绕 LTX 构建了 ComfyUI 工作流和 LoRA 生态,包括说话头像(AV LoRA)、绿幕头像、FPV 无人机运镜、音频驱动生成等。LTX Desktop 桌面端应用支持 Windows/Linux NVIDIA GPU 本地运行。
与竞品的开放性对比
LTX 在官方对比表中强调了几个差异化点:
| 能力 | LTX 2.5 | MiniMax H3 | Seedance 2.5 | Kling 3.0 Pro | Veo 3.1 | Grok 1.5 |
|---|---|---|---|---|---|---|
| 开放权重 | 完整开放 | 部分开放 | 否(Closed API) | 否 | 否 | 否 |
| 管辖法律 | 美国 | 中国 | 中国 | 中国 | 美国 | — |
| 最低显存 | 16GB | ~115GB(4 GPU) | — | — | — | — |
| 部署方式 | 本地+边缘+API | 自托管+API | 仅 API | 仅 API | 仅 API | 仅 API |