logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

LTX-2 19B Text-to-Video LoRA:生成带同步音频的逼真文本视频 | RunComfy

ltx/ltx-2-19b/text-to-video/lora

将文本提示词生成带同步音频的视频,通过 LoRA 控制风格,并提供 4K 级清晰度与流畅运动,适合电影感广告、故事短片和品牌内容。

输出分辨率。
输出格式。
视频时长(5–20 秒,默认 5 秒)。
要应用的 LoRA 列表(最多 3 个)。
用于复现结果的随机种子(-1 表示随机)。
Idle
The rate is $0.017 per second for 480p, $0.022 per second for 720p, and $0.033 per second for 1080p.

LTX-2 19B Text-to-Video LoRA 简介

Lightricks 的 LTX-2 19B Text-to-Video LoRA 可将提示词生成音视频同步的短片:480p 每秒 0.017 美元、720p 每秒 0.022 美元、1080p 每秒 0.033 美元;支持 5–20 秒时长,模型能力最高可达原生 4K、50 fps,并在一次生成中完成音视频同步和基于 LoRA 的风格控制。它以模态感知控制、摄影机运动与 IC-LoRA 引导以及稳定的角色风格,取代手工逐帧编辑、独立音频后期和大量遮罩合成,帮助电影制作、VFX、游戏、教育和营销团队简化短视频制作并省去重新同步流程。
适合:高转化视频广告 | 电影预演 | 保持品牌一致的社交短片

Lightricks / LTX-2 19B Text-to-Video LoRA#


LTX-2 19B Text-to-Video LoRA 是一款拥有 190 亿参数、支持 LoRA 适配的 Diffusion Transformer,可直接根据文本生成带同步音频的短视频。它接受提示词和可选 LoRA 适配器,输出构图连贯、风格明确的视频,支持多种分辨率、时长和宽高比,适用于品牌内容、社交媒体、动画和快速原型制作。


输出规格:480p–1080p / 时长 5–20 秒 / 宽高比 16:9 或 9:16 / 包含音频


亮点#

  • LoRA 定制:最多应用 3 个适配器,用于控制风格、角色或运动,同时尽量保持场景意图。
  • 一次生成音视频:同时生成画面与声音,使环境音、音效或对白自然同步。
  • 灵活输出:可选 480p、720p、1080p;16:9 或 9:16;时长 5–20 秒。
  • 可复现迭代:固定 seed 后,可在保持基础结果的前提下逐步优化 prompt。
  • 角色和运动一致性:通常能在跨帧过程中保持主体连贯与平滑过渡。
  • 高效流程:可接入 RunComfy,无需自建基础设施,并适合通过 API 快速迭代。

参数#


参数必填类型默认值范围/选项说明
prompt*是 (*)string——描述场景、动作和音频要求
resolution否enum720p480p、720p、1080p输出分辨率
aspect_ratio否enum16:916:9、9:16输出宽高比
duration否number55–20 秒视频时长
loras否list—最多 3 个要应用的 LoRA 适配器列表
seed否integer-1-1 表示随机用于复现结果的随机种子

价格#


LTX-2 19B Text-to-Video LoRA 按生成视频的秒数和分辨率计费。


分辨率每秒价格计费单位
480p$0.017每生成 1 秒
720p$0.022每生成 1 秒
1080p$0.033每生成 1 秒

使用方法#


  1. 在 RunComfy 模型目录中选择 LTX-2 19B Text-to-Video LoRA。
  2. 编写 prompt:说明主体、动作、环境、摄影机运动、光线,以及环境音、音效或对白等关键音频要求。
  3. 添加适配器(可选):在 loras 中指定最多 3 个 LoRA,用于引导风格或角色身份。
  4. 设置输出:选择 resolution(480p/720p/1080p)、aspect_ratio(16:9 或 9:16)和 duration(5–20 秒)。
  5. 控制复现:将 seed 设为固定整数可复现结果,设为 -1 则生成新的变化。
  6. 生成并预览带同步音频的单个视频文件。
  7. 检查并迭代:调整 prompt 或 LoRA 列表;如果构图不合适,可修改时长或宽高比,并使用相同 seed 进行可控比较。
  8. API 自动化:通过 RunComfy API 批量提交任务,无需管理基础设施或 GPU。

提示词与参考技巧#


  • 从具体信息开始:说明主体、动作、镜头类型(如“广角跟拍”)和音频意图(如“细雨声、远处车流”)。
  • 保持风格统一:避免混合相互冲突的美学方向;每段视频通常使用一个主要风格或角色 LoRA 更稳定。
  • 合理设置时长:5–8 秒的短片通常运动更紧凑;只有叙事需要时才延长到 20 秒。
  • 固定 seed 后小幅调整 prompt,有助于稳定比较不同结果。
  • 为平台构图:竖屏社交内容使用 9:16,横屏使用 16:9,并按分发渠道选择分辨率。
  • 避免过载:同时安排太多动作或音效可能降低连贯性,应优先保留最重要的叙事节点。
  • 常见修正:画面过于拥挤时可缩短时长或切换宽高比;风格过强时可移除 LoRA 或降低适配器影响。

更多可尝试的模型#


  • LTX-2 19B Image-to-Video LoRA
  • LTX-2 19B Video-to-Video LoRA

官方资源#


  • 官方网站:https://app.ltx.studio/ltx-2-playground/t2v
  • 官方 GitHub:https://github.com/Lightricks/LTX-2/tree/main
  • 官方 Hugging Face:https://huggingface.co/Lightricks/LTX-2

相关模型

sync/lipsync/v2

根据必填视频 URL 和音频 URL 创建口型同步视频。可选择 `lipsync-2` 或 `lipsync-2-pro`;相同时长下,Pro 费用约为基础版的 1.67 倍。另有五种时长不一致处理模式。

kling-video-o3/standard/reference-to-video

根据参考素材生成 3–15 秒视频,起价为每秒 $0.084。

wan-2-2/lora/image-to-video

根据提示词让起始图像动起来,并设置 LoRA、帧数、FPS、分辨率、宽高比、推理步数和随机种子。

veo-3/text-to-video

使用 Google Veo 3 根据文本提示词生成视频,并选择是否生成音频。

wan-2-2/fun-control

通过首帧风格控制,让AI视频从始至终保持统一视觉效果,轻松实现创意再现。

minimax-h3-open/reference-to-video

来自图像、视频和音频提示的视频的开放权重参考。

常见问题

LTX-2 19B Text-to-Video LoRA 的输出分辨率和宽高比有哪些技术限制?

模型能力最高可达原生 4K(3840×2160)、50 fps;当前可选预设为 480p、720p 和 1080p,宽高比支持 16:9 与 9:16。每次生成的文本提示词上限约为 512 tokens。

LTX-2 19B Text-to-Video LoRA 最多可以同时应用多少个适配器?

最多可同时加载 3 个 LoRA 模块,其中可包括用于姿态、深度或边缘引导等控制信号的 IC-LoRA,以增强文生视频画面的结构一致性。

如何从 RunComfy 模型页面过渡到生产部署?

先在 RunComfy 的浏览器界面中调整提示词和参数;准备投入生产后,再通过 RunComfy API 自动执行文生视频、加载风格适配器和接入后处理流程。API 使用同一套按美元计价的额度系统。

哪些内容生成任务最适合 LTX-2 19B Text-to-Video LoRA?

它适合营销短片、教学讲解、动画角色对话和风格化短视频。高帧率、同步音频、稳定的文本遵循与可配置 LoRA,有助于维持品牌一致性并提高创意制作效率。

LTX-2 19B Text-to-Video LoRA 如何实现音视频同步?

它采用 Diffusion Transformer(DiT)主干,同时建模视频帧和对应音频波形,并在一次推理中完成文生视频,从而让对白时序、口型和环境音自然对齐,无需另行合成音频。

可以为 LTX-2 19B Text-to-Video 训练自定义 LoRA,而不重新训练整个模型吗?

可以。轻量 LoRA 训练流程可高效微调风格、运动或角色表征,再将适配器接入主流程,在保持文生视频一致性的同时形成独特的创意或品牌风格。你也可以使用 RunComfy Trainer 训练自己的 LoRA。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Max
  • MiniMax H3 Max Reference to video
  • MiniMax H3 Max text to video
  • MiniMax H3 Open Reference To Video
  • Wan 3.0 Prime
  • Wan 2.7 Image to Video
  • 查看所有模型 →
图像模型
  • Wan 2.6 Image to Image
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • GPT Image 2 Image Edit
  • Qwen Image 3.0 Edit
  • Qwen Image 3.0 Pro Edit
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

LTX-2 19B Text-to-Video LoRA 生成示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...