跳转到主要内容

LTX-2.5 正式发布:开源视频模型,中小企业免费,ComfyUI 原生支持

LTX 公司今日正式发布了其开源视频与世界模型 LTX-2.5,这一模型已在 Hugging Face 平台上线,并与 ComfyUI 达成战略合作,实现了原生集成。同时,LTX 还提供了托管 API 服务,方便开发者快速接入。

在商业模式上,LTX 采取了分层授权的策略。对于年经常性收入(ARR)低于 1000 万美元的中小企业,可以免费使用该模型;而大型企业则需要与 LTX 协商授权事宜。截至目前,该系列模型的下载量已超过 3300 万次,足见其在开发者社区中的受欢迎程度。

Image

LTX-2.5 在生成流程上进行了深度重构,核心升级包括:引入了新的扩散视频解码器,以增强细节和图像质量;支持原生多相机单次渲染;集成了定制的 Gemma4 语言骨干网络;并针对物理 AI 和机器人技术提供了专门的预训练检查点。得益于 NVIDIA 的优化,其高效蒸馏模型可以在 RTX GPU 和 Mac 等硬件上经济高效地运行。官方数据显示,该模型的生成成本约为同类模型的八分之一,渲染速度则快了七倍。

在性能方面,LTX 使用两块顶级 NVIDIA GB200 芯片进行了自托管测试,生成一段 10 秒的 720p 视频仅需 6.8 秒,比实时播放还要快;在质量盲测中,其胜率达到了 67%。LTX 首席执行官 Zeev Farbman 表示,押注开源权重是为了通过开放性吸引开发者,并采取“本地验证优先,再商业授权”的路径,精准切入虚拟制作、实时机器人、边缘计算等多样化的企业级应用场景。

关键要点

  • 开源与集成:LTX-2.5 已在 Hugging Face 上线,并与 ComfyUI 原生集成,提供托管 API。
  • 分层授权:年收入低于 1000 万美元的企业可免费使用,大型企业需协商授权。
  • 性能卓越:生成成本约为同类模型的 1/8,渲染速度快 7 倍;自测中 10 秒 720p 视频生成仅需 6.8 秒。
  • 技术升级:引入扩散视频解码器、多相机渲染、Gemma4 语言骨干,并针对物理 AI 和机器人优化。
  • 市场反响:系列模型下载量已超 3300 万次,质量盲测胜率 67%。