
一段提示词,直接生成 LTX 2.5 视频
把场景、动作和运镜写清楚,LTX 2.5 视频模型就会渲染出一条带声音的成片。定制的 Gemma 4 12B 文本编码器能在复杂提示词中持续跟踪主体、动作、光线和镜头方向,Auto Duration 会在扩散开始前根据动作描述自动选定片长——一条 LTX 2.5 提示词,就足以拿到一条能用的成片。
Vogoo.aiLTX 2.5 是 Lightricks 在 2026 年 8 月 11 日发布的开源权重音视频模型。这个 LTX 2.5 AI 视频生成器在同一个浏览器工作台里跑 Pro 与 Fast 两个端点:一段提示词或一张静态图片,就能变成 6 到 20 秒的 LTX 2.5 视频,自带同步音频、多镜头衔接,最高 4K 输出。

LTX 2.5 生成视频这件事,涵盖文生视频、带末帧控制的图生视频、原生多镜头、同步音频和最高 4K 输出——一个 LTX 2.5 模型,顶过去五个工具。

把场景、动作和运镜写清楚,LTX 2.5 视频模型就会渲染出一条带声音的成片。定制的 Gemma 4 12B 文本编码器能在复杂提示词中持续跟踪主体、动作、光线和镜头方向,Auto Duration 会在扩散开始前根据动作描述自动选定片长——一条 LTX 2.5 提示词,就足以拿到一条能用的成片。

上传一张照片、一张产品渲染图或一张分镜稿,再补一句要发生什么,LTX 2.5 会让它动起来,同时保住主体、光线和构图。图生视频还支持末帧输入,你可以精确钉住镜头结束的画面——从首帧到末帧的完整过渡,而不是一次猜测。

LTX 2.5 的原生多镜头能力可以一次生成多个相互衔接的镜头,角色、环境、光线、声音和风格在每个切点之间保持一致。你描述的是整个场景而不是单个镜头,模型在内部处理切点——不需要拼接多个独立生成,镜头之间也不会漂移。

LTX 2.5 是按音视频模型训练的,声音和画面来自同一次渲染。把音频打开,环境声、动作音和对白就会落在与画面同一条时间线上——不用再开第二个工具,也不用手动对轨,价格里已包含音频。

LTX 2.5 用 Diffusion Video Decoder 取代了普通 VAE 解码。人脸保持清晰,画面中的文字保持可读,快速运动也少有拖影——这是相比 LTX 2.3 最大的画质提升,定格任何一帧都看得出来。

Pro 端点在 720p 或 1080p 下输出 6、8 或 10 秒片段,Diffusion Fidelity Rendering 会把更多算力投给复杂场景。Fast 端点最高可达 1440p 和 4K、50fps,片长上限 20 秒——先在预览里快速迭代,最后交付 4K 成片。
LTX 2.5 和 LTX 2.3 的区别,在于新解码器、原生多镜头和更强的文本编码器——画质差距直接体现在人脸、文字和快速运动上。
| 对比项 | LTX 2.5 | LTX 2.3 |
|---|---|---|
| 视频解码 | Diffusion Video Decoder(人脸更清晰、文字可读) | VAE 解码 |
| 多镜头 | 原生多镜头——一次生成多个衔接的镜头 | 单镜头生成 |
| 文本编码器 | Gemma 4 12B,支持复杂多主体提示词 | 上一代编码器 |
| 音频 | 默认同步生成 | 默认同步生成 |
| 分辨率与速度 | Pro 720p/1080p;Fast 最高 4K、50fps | 最高 4K 输出 |
| 时长 | Pro 6–10 秒;Fast 最高 20 秒 | Fast 最高 20 秒 |
| 适合做什么 | 多镜头叙事、4K 主片、专业调色流程 | 短电影感片段与快速迭代 |
LTX 2.5 不是 LTX 2.3 的小版本更新——它更换了解码器、加入了原生多镜头、升级了文本编码器,画质差距直接体现在人脸、文字和快速运动上。本页把 LTX 2.5 当作文生视频与图生视频生成器来用。
在它之前,每一代 LTX 模型一次只生成一个镜头。LTX 2.5 是这条开源权重线路上第一个把镜头接起来、把细节做锐、把输出推到 4K 的版本。
2024 年 11 月让 LTX 一战成名的版本:Lightricks 出品的快速开源文生视频模型,人人都能在本地跑。家族的速度标杆就是从它开始立起来的。
面向专业制作的视频模型一代:精确控制、原生 4K、高帧率、长内容创作工作流。在 2.3 之前,大多数 LTX 对比都从这里起步。
上一代开源权重版本:最高 4K、20 秒、原生音频,新 VAE 带来更锐利的细节,支持 LoRA 微调。Vogoo 的视频工具里仍然跑着 LTX 2.3。
最新的 LTX 模型,2026 年 8 月 11 日以 22B 开源权重音视频基础模型发布。Diffusion Fidelity Rendering、原生多镜头、Diffusion Video Decoder,外加面向微调的 raw pretrained checkpoint——本页跑的就是它。
LTX 2.5 由 LTX 打造,也就是从 Lightricks 分拆出来、拥有 LTX 模型家族的那家生成式媒体公司。
LTX 2.5 适合所有需要快速拿到一段可信短镜头的人——投放、创作者、产品团队、影视从业者、美术和调色团队。
不用实拍就能批量出付费社交广告的素材版本。先写好钩子,渲染一条 1080p 的 LTX 2.5 视频,再用同一个创意出一条竖版,同一周内就能把两版一起投出去测。
一张静图——照片、封面图或者一张主视觉——就能变成带声音的 9:16 竖版片段。用 LTX 2.5 图生视频,你完全不用打开剪辑时间线,也能发动态内容。
让产品渲染图动起来:物体旋转、表面反光、落下时有真实的重量感。LTX 2.5 图生视频的末帧控制可以把最终构图钉死,做出干净的循环镜头。
在叫团队之前先把镜头搭出来。把场景描述清楚,让原生多镜头在内部处理切点,用生成出来的 LTX 2.5 片段当会动的故事板,去争取你真正想要的那套拍法。
把一张概念图推成动态,看看这个想法读起来是不是一个动作,而不只是一个姿势。一条 6 秒的 LTX 2.5 片段成本足够低,可以先试三个方向再定稿。
LTX 2.5 支持原生 EXR 工作流,可以在 ACES 和 DaVinci Wide Gamut 等专业色彩空间里读写电影级 EXR,生成式修改能直接走真实调色管线,无需有损的 8-bit 中转。
LTX 2.5 的流程一直很短:描述或上传素材,设好片长、画幅和分辨率,然后生成并下载成片。
步骤 01
在文生视频标签页里写一段提示词——主体、动作、光线和运镜都会被 LTX 2.5 文本编码器跟踪;或者切到图生视频,上传你想让它动起来的那张静图。
步骤 02
选 Pro 的 6、8 或 10 秒,或者 Fast 最长 20 秒的片段。在 720p、1080p、1440p 或 4K 里选分辨率,挑 16:9 或 9:16,再决定原生音频要不要打开。
步骤 03
点击生成,在预览区里对比几条结果,然后下载 MP4——全程都不用离开 Vogoo 工作台。
这里回答 LTX 2.5 是什么、免不免费、什么时候发布、与 2.3 的区别、开源协议、权重下载、音频、MiniMax H3 对比以及多镜头。
LTX 2.5 是 Lightricks 在 2026 年 8 月 11 日发布的最新开源权重音视频模型,22B 基础模型。它可以在最高 4K、50fps 下生成带同步音频的视频,一次生成中保持多个衔接镜头的一致性,还附带一个供微调的 raw pretrained checkpoint。在本页里,LTX 2.5 以文生视频和图生视频生成器的形态运行。
把一段提示词或一张静图,变成一条自带原生音频、多镜头衔接的 LTX 2.5 视频——最高 4K,都在同一个 Vogoo 工作台里完成。