Lightricks 推出的 LTX 系列第三代旗舰:22B DiT 一次生成"带原生立体声的多镜头视频",主打 open weights、本地可跑、社区微调友好——开源视频模型与闭源 Sora/Veo 阵营对垒的新主力。核心能力围绕规模、文本编码、新diffusion视频解码器展开。

| 项目 | 内容 |
|---|---|
| HF 地址 | https://huggingface.co/Lightricks/LTX-2.5 |
| 类型 | 22B DiT 视频生成 / 世界模拟模型(text/image/video/audio → video+audio) |
| trendingScore | 349 |
| 许可证 | LTX-2.x Community License(年收入 < $10M 免费商用) |
| 榜单 | HuggingFace 热榜第 8 名 |
Lightricks 推出的 LTX 系列第三代旗舰:22B DiT 一次生成"带原生立体声的多镜头视频",主打 open weights、本地可跑、社区微调友好——开源视频模型与闭源 Sora/Veo 阵营对垒的新主力。
三大卖点同时命中社区痛点:原生多镜头一致性(角色/光照/配音/风格跨镜头保持)是当前文生视频最大的工程缺口;官方蒸馏版 8 步采样把消费级显卡出片变成现实;月下载约 894K、25 个量化版 + 19 个微调 + 9 个适配器的衍生生态展示了罕见的繁殖力。ComfyUI 官方模板内置进一步压低体验门槛。(数据为采集时点信息)
三条路线:① 官方 `ltx-pipelines`(Python ≥3.12、CUDA ≥12.7、PyTorch ≈2.7);② ComfyUI 内置工作流模板(int8 checkpoint 仅限 ComfyUI);③ Diffusers 走 `Lightricks/LTX-2.5-Diffusers`(需安装 diffusers 主分支)。蒸馏版 CLI 示例:
uv run python -m ltx_pipelines.distilled \
--transformer-path models/ltx-2.5/diffusion_models/ltx-2.5-22b-distilled-transformer-bf16.safetensors \
--text-encoder-path models/ltx-2.5/text_encoders/gemma4-12b-with-proj-ltx-2.5-bf16.safetensors \
--video-vae-path models/ltx-2.5/vae/ltx-2.5-video-vae-bf16.safetensors \
--prompt "A golden retriever running through a sunny meadow" --seed 42
图像条件经 `--image PATH FRAME_IDX STRENGTH` 追加;低显存加 `--quantization fp8-cast --offload cpu`。注意仓库为 gated:需登录同意隐私政策后下载。
消费级优先蒸馏版 + fp8/int8 量化 + CPU offload,可在 16–24GB 显存完成短片创作;专业产出建议云端 A100/H100 跑完整版两阶段上采样管线;批量内容工厂可用 8 步蒸馏版稳定控时;商用前核对许可——年收入 ≥ $10M 的主体需付费协议。
带旁白与音效的营销短视频一条龙生成;多镜头短剧/广告分镜原型;影视预演与 storyboard 动态化;游戏与数字内容的 world simulation 素材生产;LoRA 定制风格化的品牌视觉资产。
对比 Wan/HunyuanVideo 系:LTX-2.5 是少数视频+音频联合输出且提供成熟商业工具链(LTX-2 Trainer/ComfyUI 官方支持)的方案;对比闭源 Veo/Sora:开放权重可本地化与微调是决定性差异;对比上代 LTX-2.3:解码器、多镜头一致性与时长推断全面升级,旧 LoRA 多数直接兼容。
模型页 https://huggingface.co/Lightricks/LTX-2.5 · Diffusers 版仓库 Lightricks/LTX-2.5-Diffusers · 官方 ltx-pipelines 包与 LTX-2 Trainer · ComfyUI 工作流模板