Vogoo.ai logoVogoo.ai
X (Twitter)
升级
视频
图像
音频
提示词模板
AI 工具
AI 特效
AI 女孩
AI 模型
素材

LTX 2.5 AI 视频生成器

LTX 2.5 是 Lightricks 在 2026 年 8 月 11 日发布的开源权重音视频模型。这个 LTX 2.5 AI 视频生成器在同一个浏览器工作台里跑 Pro 与 Fast 两个端点:一段提示词或一张静态图片,就能变成 6 到 20 秒的 LTX 2.5 视频,自带同步音频、多镜头衔接,最高 4K 输出。

LTX 2.5 视频 · 6–20 秒最高 4K 与 50fps原生音频多镜头衔接
生成 LTX 2.5 视频
LTX 2.5 AI 视频生成器展示图——由提示词生成的电影感视频画面

什么是 LTX 2.5 视频模型?

LTX 2.5 生成视频这件事,涵盖文生视频、带末帧控制的图生视频、原生多镜头、同步音频和最高 4K 输出——一个 LTX 2.5 模型,顶过去五个工具。

LTX 2.5 AI 文生视频效果——由一段提示词生成的电影感场景

一段提示词,直接生成 LTX 2.5 视频

把场景、动作和运镜写清楚,LTX 2.5 视频模型就会渲染出一条带声音的成片。定制的 Gemma 4 12B 文本编码器能在复杂提示词中持续跟踪主体、动作、光线和镜头方向,Auto Duration 会在扩散开始前根据动作描述自动选定片长——一条 LTX 2.5 提示词,就足以拿到一条能用的成片。

LTX 2.5 AI 图生视频效果——静态照片被转成会动的镜头

图生视频:动起任何一张静图,还能钉住末帧

上传一张照片、一张产品渲染图或一张分镜稿,再补一句要发生什么,LTX 2.5 会让它动起来,同时保住主体、光线和构图。图生视频还支持末帧输入,你可以精确钉住镜头结束的画面——从首帧到末帧的完整过渡,而不是一次猜测。

LTX 2.5 AI 多镜头效果——一次生成里包含两个衔接的镜头

原生多镜头:一次生成,多个衔接的镜头

LTX 2.5 的原生多镜头能力可以一次生成多个相互衔接的镜头,角色、环境、光线、声音和风格在每个切点之间保持一致。你描述的是整个场景而不是单个镜头,模型在内部处理切点——不需要拼接多个独立生成,镜头之间也不会漂移。

LTX 2.5 AI 原生音频效果——画面与生成音效同步的场景

同步音频,与画面在同一次渲染中产出

LTX 2.5 是按音视频模型训练的,声音和画面来自同一次渲染。把音频打开,环境声、动作音和对白就会落在与画面同一条时间线上——不用再开第二个工具,也不用手动对轨,价格里已包含音频。

LTX 2.5 AI 高清细节——面部细节干净锐利的特写画面

Diffusion Video Decoder:人脸更清晰,文字可读

LTX 2.5 用 Diffusion Video Decoder 取代了普通 VAE 解码。人脸保持清晰,画面中的文字保持可读,快速运动也少有拖影——这是相比 LTX 2.3 最大的画质提升,定格任何一帧都看得出来。

LTX 2.5 AI 4K 画质细节——在 Vogoo 工作台里预览的高分辨率片段

6 到 20 秒,最高 4K、50fps

Pro 端点在 720p 或 1080p 下输出 6、8 或 10 秒片段,Diffusion Fidelity Rendering 会把更多算力投给复杂场景。Fast 端点最高可达 1440p 和 4K、50fps,片长上限 20 秒——先在预览里快速迭代,最后交付 4K 成片。

LTX 2.5 与 LTX 2.3 对比:新一代 LTX 多了什么

LTX 2.5 和 LTX 2.3 的区别,在于新解码器、原生多镜头和更强的文本编码器——画质差距直接体现在人脸、文字和快速运动上。

LTX 2.5 与 LTX 2.3 在解码方式、多镜头、音频、分辨率、时长和适用场景上的对比
对比项LTX 2.5LTX 2.3
视频解码Diffusion Video Decoder(人脸更清晰、文字可读)VAE 解码
多镜头原生多镜头——一次生成多个衔接的镜头单镜头生成
文本编码器Gemma 4 12B,支持复杂多主体提示词上一代编码器
音频默认同步生成默认同步生成
分辨率与速度Pro 720p/1080p;Fast 最高 4K、50fps最高 4K 输出
时长Pro 6–10 秒;Fast 最高 20 秒Fast 最高 20 秒
适合做什么多镜头叙事、4K 主片、专业调色流程短电影感片段与快速迭代

LTX 2.5 不是 LTX 2.3 的小版本更新——它更换了解码器、加入了原生多镜头、升级了文本编码器,画质差距直接体现在人脸、文字和快速运动上。本页把 LTX 2.5 当作文生视频与图生视频生成器来用。

LTX 2.5 在 LTX 模型家族里的位置

在它之前,每一代 LTX 模型一次只生成一个镜头。LTX 2.5 是这条开源权重线路上第一个把镜头接起来、把细节做锐、把输出推到 4K 的版本。

LTX Video——最初的 LTX 开源模型

2024 年 11 月让 LTX 一战成名的版本:Lightricks 出品的快速开源文生视频模型,人人都能在本地跑。家族的速度标杆就是从它开始立起来的。

LTX-2——面向生产的视频模型基线

面向专业制作的视频模型一代:精确控制、原生 4K、高帧率、长内容创作工作流。在 2.3 之前,大多数 LTX 对比都从这里起步。

LTX-2.3——22B 开源音视频模型

上一代开源权重版本:最高 4K、20 秒、原生音频,新 VAE 带来更锐利的细节,支持 LoRA 微调。Vogoo 的视频工具里仍然跑着 LTX 2.3。

LTX-2.5——世界模型这一代

最新的 LTX 模型,2026 年 8 月 11 日以 22B 开源权重音视频基础模型发布。Diffusion Fidelity Rendering、原生多镜头、Diffusion Video Decoder,外加面向微调的 raw pretrained checkpoint——本页跑的就是它。

LTX 2.5 由 LTX 打造,也就是从 Lightricks 分拆出来、拥有 LTX 模型家族的那家生成式媒体公司。

LTX 2.5 都被拿来做什么:广告、社交与故事内容

LTX 2.5 适合所有需要快速拿到一段可信短镜头的人——投放、创作者、产品团队、影视从业者、美术和调色团队。

效果营销与投放

不用实拍就能批量出付费社交广告的素材版本。先写好钩子,渲染一条 1080p 的 LTX 2.5 视频,再用同一个创意出一条竖版,同一周内就能把两版一起投出去测。

社交与短视频创作者

一张静图——照片、封面图或者一张主视觉——就能变成带声音的 9:16 竖版片段。用 LTX 2.5 图生视频,你完全不用打开剪辑时间线,也能发动态内容。

电商与产品团队

让产品渲染图动起来:物体旋转、表面反光、落下时有真实的重量感。LTX 2.5 图生视频的末帧控制可以把最终构图钉死,做出干净的循环镜头。

影视与分镜预演

在叫团队之前先把镜头搭出来。把场景描述清楚,让原生多镜头在内部处理切点,用生成出来的 LTX 2.5 片段当会动的故事板,去争取你真正想要的那套拍法。

游戏与概念美术

把一张概念图推成动态,看看这个想法读起来是不是一个动作,而不只是一个姿势。一条 6 秒的 LTX 2.5 片段成本足够低,可以先试三个方向再定稿。

调色与后期团队

LTX 2.5 支持原生 EXR 工作流,可以在 ACES 和 DaVinci Wide Gamut 等专业色彩空间里读写电影级 EXR,生成式修改能直接走真实调色管线,无需有损的 8-bit 中转。

三步用 LTX 2.5 生成视频

LTX 2.5 的流程一直很短:描述或上传素材,设好片长、画幅和分辨率,然后生成并下载成片。

01
1

步骤 01

描述或上传

在文生视频标签页里写一段提示词——主体、动作、光线和运镜都会被 LTX 2.5 文本编码器跟踪;或者切到图生视频,上传你想让它动起来的那张静图。

02
2

步骤 02

设置片长、画幅和分辨率

选 Pro 的 6、8 或 10 秒,或者 Fast 最长 20 秒的片段。在 720p、1080p、1440p 或 4K 里选分辨率,挑 16:9 或 9:16,再决定原生音频要不要打开。

03
3

步骤 03

生成并下载

点击生成,在预览区里对比几条结果,然后下载 MP4——全程都不用离开 Vogoo 工作台。

LTX 2.5 常见问题

这里回答 LTX 2.5 是什么、免不免费、什么时候发布、与 2.3 的区别、开源协议、权重下载、音频、MiniMax H3 对比以及多镜头。

LTX 2.5 是 Lightricks 在 2026 年 8 月 11 日发布的最新开源权重音视频模型,22B 基础模型。它可以在最高 4K、50fps 下生成带同步音频的视频,一次生成中保持多个衔接镜头的一致性,还附带一个供微调的 raw pretrained checkpoint。在本页里,LTX 2.5 以文生视频和图生视频生成器的形态运行。

搭配 LTX 2.5 一起用的更多 Vogoo 工具

文生视频图生视频MiniMax H3Flux 3Wan 2.7

现在就免费用 LTX 2.5 开始创作

把一段提示词或一张静图,变成一条自带原生音频、多镜头衔接的 LTX 2.5 视频——最高 4K,都在同一个 Vogoo 工作台里完成。

生成 LTX 2.5 视频查看价格