ComfyUI>工作流>LTX 2.5 ComfyUI 文本转视频 | 原生多镜头 & 4K HDR

LTX 2.5 ComfyUI 文本转视频 | 原生多镜头 & 4K HDR

Workflow Name: RunComfy/LTX-2.5-ComfyUI-T2V
Workflow ID: 0000...1490
使用 LTX-2.5 文本转视频生成器将您的提示词转化为短电影剪辑。您将获得同步的音频和流畅的运动。自动增强提示词。放大潜在细节以获得更清晰的帧。原型场景、产品镜头和角色时刻。在 RunComfy 中快速运行。

LTX 2.5 ComfyUI Text to Video Workflow

LTX 2.5 ComfyUI Text to Video | Upscaling + Synced Audio
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

LTX 2.5 ComfyUI Text to Video Examples

LTX 2.5 ComfyUI 文本转视频:提示词到视频与同步音频#

LTX 2.5 ComfyUI 文本转视频是一个适用于 RunComfy 的工作流程,它将简短的书面提示词转换为具有对齐音轨的电影视频。它结合了 Lightricks 的 LTX-2.5 蒸馏变换器用于文本转视频生成,紧凑的视频/音频 VAE 用于重建,潜在放大器用于更清晰的细节,以及基于 Gemma 的提示词增强以加强提示词的遵从性。

专为希望在 ComfyUI 中快速进行本地优先迭代的创作者而设计,此图在氛围场景、产品镜头、角色时刻和情绪片段中表现出色。使用 LTX 2.5 ComfyUI 文本转视频,您可以在几分钟内从想法转到预览,然后在不离开 RunComfy 的情况下优化运动、外观和时间。

Comfyui LTX 2.5 ComfyUI 文本转视频工作流程中的关键模型#

  • Lightricks LTX-2.5。合成从文本到视频的时间一致性视频的核心蒸馏变换器。它在保持推理速度的同时平衡了提示词的忠实性和运动现实主义。请参阅 Lightricks/LTX-2.5 的官方模型卡和 Lightricks/LTX-2.5-Diffusers 的参考管道。
  • Google Gemma 2 Instruct。用于在生成之前扩展和澄清用户提示词的紧凑指令调优语言模型,改善风格指导和镜头意图。代表性检查点是 google/gemma-2-9b-it
  • Lightricks 组织中心。LTX 版本和更新的中央列表,适用于文本转视频系列,便于查阅模型说明和已知行为:huggingface.co/Lightricks

如何使用 Comfyui LTX 2.5 ComfyUI 文本转视频工作流程#

此工作流程遵循从提示词到视频的清晰路径:提示词增强、文本条件、潜在视频合成、放大、解码、音频对齐和导出。以下部分用简单的语言解释了每个阶段,以便您知道要更改什么以及为什么。

提示词和预设#

首先编写一个简洁的提示词,说明主题、环境、照明、镜头或相机感受和运动意图。可以选择添加一个负面提示词以避免不需要的元素。如果提供了风格预设,请选择一个以快速设置颜色和对比度倾向。如果图形公开种子控制,请在迭代措辞时保持种子稳定,以便差异反映您的编辑而非随机性。LTX 2.5 ComfyUI 文本转视频受益于明确的运动动词,例如“缓慢推入”、“手持”或“轻微微风”。

文本条件#

您的提示词被标记化并编码,然后由 Gemma 轻微重写以加强意图并消除歧义。增强的文本创建了视频模型用于决定布局、主题外观和运动提示的条件向量。保持描述具体和可视化;避免长列表的修饰符彼此竞争。如果您需要一致的身份或品牌,请将这些术语放在提示词的开头。这一步是 LTX 2.5 ComfyUI 文本转视频在生成任何像素之前锁定含义的地方。

潜在视频合成#

工作流程初始化一个符合您选择的宽高比和持续时间的潜在时间线。LTX-2.5 迭代地去噪此潜在视频,将结构、运动和外观编织到每一帧中,同时保持时间一致性。较短的镜头收敛得更快且更容易引导;只有在您喜欢第一个节拍后才延长持续时间。使用负面提示词来抑制如多余肢体、闪烁或文本覆盖等伪影。这里的目标是一个干净、符合简要的潜在剪辑,已经可以看作是您预期的场景。

运动和时间#

在去噪过程中,模型平衡空间细节和流畅运动。您提示词中的强运动提示有助于避免静态外观的剪辑;过多的细粒度纹理需求可能会降低运动清晰度。如果图形包括一个运动强度控制,增加它以获得动态镜头,减少它以获得人像或微距产品角度。在测试变化时,每次只更改一个元素,以便您可以将差异归因于特定编辑。LTX 2.5 ComfyUI 文本转视频通常奖励清晰的相机动词和单一主题聚焦。

潜在放大#

专用的潜在放大器在不破坏时间稳定性的情况下细化细节。当基本运动和构图看起来正确时启用此过程。如果高光泛滥或边缘过度锐化,略微降低强度并重新运行;如果图像感觉柔和,则增加强度。在运动稳定后进行放大比从更高的基本分辨率开始更好地保持一致性。这个阶段使 LTX 2.5 ComfyUI 文本转视频在不引入闪烁的情况下获得清晰度。

解码和色彩#

视频 VAE 将潜在的内容解码为帧,应用适合预览和导出的色彩空间和色调映射。如果可用,请选择与您的意图匹配的外观配置文件:中性用于后期调色,电影风格用于即用型日常。轻微的条纹或闪烁通常表示上游锐化过于激进;调整放大器强度而不是强迫更重的后期对比。保持宽高比一致以便公平比较结果。解码是您的帧变成像素以供评估的地方。

音频生成和同步#

音频模块从相同的提示词生成一个轻量级的音轨,并将其与视频时间线对齐。使用“诡异的嗡嗡声”、“欢快的合成器”或“柔和的雨声”等情感词来引导音床。如果工作流程公开音频切换,您可以在探索运动时禁用它,然后在最终时启用。轻微的提示词调整可以改变节奏和强度;在试听音频变化时锁定您的视觉种子。目标是支持场景而不与之冲突的连贯音频。

导出和审核#

选择您的容器和编解码器预设以获得简洁的预览或更高质量的可共享文件。如果图形包括帧导出,您可以在提交完整运行之前检查单个帧是否有伪影。记录提示词、种子和任何切换,以便您可以重现或分支想法。对于社交或产品审核,使用预览预设;对于卷轴或客户演示,使用高质量预设。LTX 2.5 ComfyUI 文本转视频经过优化,可以让您快速迭代,然后在准备好时放大和导出。

可选附加功能#

  • 用镜头语言编写提示词:主题 + 场景 + 照明 + 镜头 + 运动(例如,“大理石上的产品英雄,柔和的背光,50 mm,缓慢弧形左移”)。
  • 更喜欢一个决定性的风格提示而不是许多弱的提示。太多的形容词会稀释指导。
  • 使用负面提示词抑制文本覆盖、过多的颗粒或不需要的标志形状。
  • 锁定种子以比较提示词编辑;更改种子以探索新构图。
  • 从短开始,然后在运动清晰后延长持续时间;较长的剪辑会加剧小问题。
  • 如果面部是中心,请保持相机运动轻柔和照明稳定以减少时间漂移。
  • 为了干净的导出,避免后期调整大小;在图中设置宽高比和分辨率并保持一致。

此 LTX 2.5 ComfyUI 文本转视频工作流程旨在帮助您以最少的设置获得令人信服的运动、清晰的细节和对齐的音频。快速迭代,以清晰的意图引导,并让图形从文本到视频承担繁重的工作。

致谢#

此工作流程实现并建立在以下工作和资源之上。我们感谢 Comfy.org 提供的源工作流程模板,Lightricks 提供的 LTX-2.5 模型权重,以及 Lightricks 提供的 LTX-2.5 Diffusers 项目为其贡献和维护。有关权威详细信息,请参阅下面链接的原始文档和存储库。

资源#

注意:引用的模型、数据集和代码的使用受其作者和维护者提供的各自许可和条款的约束。

RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。