概览
LTX-2 by Lightricks 是什么?
LTX-2 是 Lightricks 开发的最先进、可立即投入生产的 AI 基础模型,用于生成同步视听内容。它是第一个完全开源、开放权重的 AI 模型,支持高达 50 FPS 的原生 4K 分辨率 (2160p) 视频生成,以及同步音频生成(包括对话、环境声音和音乐)。 LTX-2 采用 19B 参数 Diffusion Transformer (DiT) 架构,支持文本到视频和图像到视频生成,可创建长达 20 秒的剪辑。它针对 NVIDIA GPU 进行了优化,在 RTX 50 系列上提供了 3 倍的性能提升。

主要功能
- 原生 4K 分辨率 (2160p),帧速率高达 50 FPS
- 第一个用于同步音频和视频生成的开放权重模型
- 支持文本到视频和图像到视频转换
- 生成长达 20 秒且具有时间一致性的扩展剪辑
- 在 Apache 2.0 许可下完全开源(权重、代码、推理管道)
- NVIDIA 经过优化,性能提升高达 3 倍并减少 VRAM
如何使用 LTX-2 by Lightricks?
可以通过直接在浏览器中访问交互式演示来使用 LTX-2,或者使用 GitHub 和 Hugging Face 上提供的权重、训练代码和推理管道在本地部署完全开源的模型。用户可以将文本提示或静态图像转换为动态视频内容,利用多关键帧调节等功能进行高级控制。还可以通过 Fal、Replicate 和 RunDiffusion 等云 API 进行部署。
替代工具
未找到替代工具
优点 & 缺点
暂无数据
使用场景
- 内容创建(影视素材、社交媒体内容、营销视频)
- 电影和动画(预可视化、VFX 参考素材、故事板动画)
- 教育和培训(教学视频、模拟内容)
- 研究与开发(人工智能研究实验、合成数据生成)
用户评价
3.0
满分5分
3.0
暂无评价
成为第一个评价此工具的用户!