AI驱动的图像与文本转视频工具,为创作者提供灵活高效的视觉创作体验
LTX 2.5 是 Lightricks 的开放权重音频-视频模型,用于从文本、图像或音频生成同步的图片和声音。此页面运行图像到视频快速工具:以专为快速草稿构建的速度聚焦模式,将静态图像动画化为带有可选本机音频的剪辑。兄弟 RunComfy 页面涵盖同一 LTX 2.5 系列中的文本到视频和音频到视频快速模式。
当创作者需要开放权重和托管快速工具时,他们会选择 LTX 2.5。在各个任务中,LTX 2.5 在迭代时使身份和声音更加一致。许多团队从“图像到视频快速”页面开始,然后转移到其他 LTX 2.5 任务页面,而不改变创意方向。
| LTX 2.5优势 | 这对您意味着什么 |
|---|---|
| 原生多镜头连续性 | 一次性直接连接场景,使角色外观、布景、灯光、声音和等级在剪辑中保持一致。 |
| 重要的自适应细节 | 渲染预算随着场景的复杂性而变化,在需要时保持面部、纹理和屏幕类型更加清晰。 |
| 更新视频解码器 | 与早期的 LTX 一代相比,运动更清晰、重建伪影更少、细节更稳定。 |
| 更强的提示保持 | Gemma 4 12B 文本编码器加上提示增强器可帮助 LTX 2.5 保留多字符、相机和灯光指令。 |
| 快速迭代层 | 选择持续时间 auto 或固定长度,并从 720p 到 4K (2160p) 进行缩放,音频包含在速率中。 |
LTX 2.5 涵盖了兄弟快速页面中的静态动画、文本主导的草稿和音频定时剪辑;该工具专注于图像到视频。
auto 或 6–20 秒)、分辨率 (720p–2160p)、宽高比(auto、16:9、9:16)、FPS、音频开/关以及可选的摄像机运动。## 参数
此LTX 2.5 图像到视频快速页面上的控件:
| 参数 | 必填 | 类型 | 默认 | 范围/选项 | 如何选择 |
|---|---|---|---|---|---|
image_url* | 是 (*) | 图片网址 | 还是例子 | JPG、JPEG、PNG、WEBP、GIF、AVIF | 使用清晰、光线充足的静态照片;构图很大程度上锁定了 LTX 2.5 将动画化的框架。 |
end_image_url | 没有 | 图片网址 | — | 相同格式 | 仅添加开始→结束变形;留空以便从第一帧开始进行开放式运动。 |
提示* | 是 (*) | 字符串 | 示例提示 | 最多 5,000 个字符 | 在一份连贯的简介中涵盖主题动作、摄像机、灯光、风格和音频源。 |
持续时间 | 没有 | 字符串 | auto | auto、6、8、10、12、14、16、18、20 | 使用 auto 让 LTX 2.5 推断长度;当时间必须与编辑相匹配时,选择固定秒数。 |
决议 | 没有 | 字符串 | 1080p | 720p、1080p、1440p、2160p | 720p 吃水;提升英雄位置和大面积农作物。 |
aspect_ratio | 没有 | 字符串 | auto | auto、16:9、9:16 | 更喜欢auto来跟随蒸馏器;强制“16:9”或“9:16”进行平台交付。 |
fps | 没有 | 整数 | 25 | 24、25、48、50 | 匹配编辑节奏 (24/25) 或更平滑的动作 (48/50)。 |
generate_audio | 没有 | 布尔 | 真实 | “真”/“假” | 继续同步氛围、SFX 或对话;关闭静音相片。 |
camera_motion | 没有 | 字符串 | — | dolly_in、dolly_out、dolly_left、dolly_right、jib_up、jib_down、static、focus_shift | 当您希望在提示顶部指定指定的相机路径时,可选的宏移动。 |
此页面上的 LTX 2.5 按生成视频的每秒计费。 LTX 2.5 图像到视频快速包括每种分辨率的本机音频。
| 分辨率 | 每秒价格 | 6秒 | 10 秒 | 20 多岁 |
|---|---|---|---|---|
| 720p | 0.10 美元 | 0.60 美元 | 1.00 美元 | 2.00 美元 |
| 1080p | 0.14 美元 | 0.84 美元 | 1.40 美元 | 2.80 美元 |
| 1440p | 0.21 美元 | 1.26 美元 | 2.10 美元 | 4.20 美元 |
| 4K (2160p) | 0.33 美元 | 1.98 美元 | 3.30 美元 | 6.60 美元 |
对于批次,总计 ≈“持续时间 × 每秒速率 × 输出计数”。当时长为“auto”时,LTX 2.5按照实际生成时长计费。
LTX 2.5 的可重复使用结构(每个剪辑保留一个主要动作):
[屏幕上的人物/内容] + [随时间变化的动作] + [摄像机] + [灯光和环境] + [外观/等级] + [音频源] + [结尾节拍]
弱提示
> 通过精美的相机移动和声音使照片具有电影效果。
改进了 LTX 2.5 的提示
> 夜晚,在雨水打湿的东京人行道上,一位穿着木炭羊毛外套的女士站在透明雨伞下。她放下雨伞,走进人行横道,一辆黄色出租车在中间滑行,霓虹灯汉字标志在潮湿的柏油路上荡漾。锁定广角镜头,细雨条纹,柔和的反射。音频:小雨,远处的交通嗡嗡声,软轮胎在水面上发出嘶嘶声。
使用这份 LTX 2.5 家庭指南;确切的限制取决于端点。基于公开信息。
| 型号 | 杰出 | 典型贴合 |
|---|---|---|
| LTX 2.5 | 开放权重 AV 模型,具有多镜头连续性、快速模式和 4K 分辨率 | 来自静止图像、文本或音频的同步音频视频,具有可用的开放权重 |
| LTX 2 | 具有 Fast/Pro 级别的早期 Lightricks AV 生成 | 尚不需要2.5连续性升级的管道 |
| 克林3.0 | 具有强大口型同步选项的多重拍摄提示 | 脚本化的人物广告和对话主导的广告 |
| 种子之舞 2.0 / 2.5 | 跨图像、视频和音频的密集参考混合 | 品牌工作必须从许多参考资料中锁定身份 |
| 迷你最大 H3 | 具有立体声音频和参考工作流程的多模式系列 | 快速初稿,稍后可能会添加 Omni 风格参考 |
当开放权重和快速云端点都很重要时,请选择 LTX 2.5。 LTX 2.5 的与众不同之处在于一次通过原生音频的多镜头连续性。在锁定生产路径之前,跨模型运行相同的概要。
当托管草稿不够时,已发布的 LTX 2.5 权重还支持本地微调。
AI驱动的图像与文本转视频工具,为创作者提供灵活高效的视觉创作体验
将静态画面转为动作流畅、音频可控的视频片段。
根据必填提示词生成 5 秒或 8 秒视频,并可设置负面提示词、四种精确尺寸和随机种子。
智能文本转视频工具,支持1080p高质量生成,轻松打造生动镜头与真实情感,激发创作灵感。
将静态图像和文字提示快速生成逼真高清视频,展现自然动态效果。
将一张参考图制作成 5 秒或 10 秒的视频,并可设置反向提示词与原生音频生成。
LTX 2.5 将静止图像动画化为带有可选同步音频的短视频。在此页面上,您可以使用图像到视频快速工具进行快速草稿,而同级页面则涵盖同一模型系列中的文本到视频和音频到视频快速模式。
LTX 2.5 可以一次性生成连接的场景,因此角色外观、环境、灯光、声音和视觉风格在各个剪辑中保持更加一致。这有助于以前需要单独的单镜头生成的战役动画和多节拍场景。
您可以在 720p、1080p、1440p 或 4K (2160p) 处生成,持续时间设置为 auto 或 6-20 秒的固定长度。 FPS 选项包括 24、25、48 和 50,长宽比可以遵循静止图像 (auto) 或使用 16:9 或 9:16。
是的。当您想要在两个合成之间进行引导过渡时,请提供开始图像(必需)和可选的结束图像。将结束图像留空,仅用于第一帧的开放式运动。
当启用 generate_audio 时,可以随图片生成本机音频,并且音频包含在每种分辨率的每秒速率中。如果您需要静音板进行后续声音设计,请关闭音频。
提示最多可包含 5,000 个字符。开始和可选的结束图像接受常见格式,例如 JPG、PNG、WEBP、GIF 和 AVIF。检查当前的 RunComfy 参数面板以了解任何其他上传大小限制。
是的。在 RunComfy Web UI 中创建原型,然后通过 HTTP API 调用相同的 LTX 2.5 图像到视频快速模型,并使用 automation 和制作工作流程的匹配参数。
按生成视频的每秒计费:720p 为 0.10 美元,1080p 为 0.14 美元,1440p 为 0.21 美元,4K (2160p) 为 0.33 美元。当时长为auto时,按照实际产生的长度计费。几代人在 RunComfy 上消费美元/积分;新用户通常会收到免费试用金额。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





