将驱动视频中的动作迁移到参考角色图片,并可调整提示词、分辨率、推理步数、图像引导与姿态引导。
LTX 2 Fast Image-to-Video 会按照文字提示词,把一张起始图片制作成视频。图片确定初始主体与构图,提示词则描述运动、镜头方式、场景变化和声音需求。
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| image_url | string (image_uri) | Required | PNG、JPEG、WebP 或 AVIF 格式的起始图片。 |
| prompt | string | Required; example prefilled | 描述场景、运动、镜头和声音需求。 |
| duration | integer | 6, 8, 10, 12, 14, 16, 18, or 20; default: 6 | 视频时长,单位为秒。 |
| resolution | string | 1080p, 1440p, or 2160p; default: 1080p | 视频分辨率。 |
| aspect_ratio | string | 16:9 only; default: 16:9 | 仅支持 16:9。 |
| fps | integer | 25 or 50; default: 25 | 视频帧率。 |
| generate_audio | boolean | default: true | 选择是否随视频生成音频。 |
image_url 和 prompt 为必填项。duration 超过 10 秒时,即选择 12、14、16、18 或 20,必须同时把 resolution 设为 1080p、把 fps 设为 25。
image_url。prompt 中描述主体运动、镜头移动、场景变化和声音需求。aspect_ratio 保持为 16:9。duration、resolution 和 fps,并遵守长时长限制。generate_audio 设为 false。生成后,可把结果作为独立 LTX 2 Retake Video 工作流的源素材;具体输入与行为以该页面说明为准。
本页面的 schema 没有给出固定渲染速度、延迟、质量优势或许可承诺。用于正式制作前,请查阅当前产品与提供方条款。
The rate is $0.044 per second for 1080p, $0.088 per second for 1440p, and $0.176 per second for 2160p.
将驱动视频中的动作迁移到参考角色图片,并可调整提示词、分辨率、推理步数、图像引导与姿态引导。
应用一个自定义 LoRA,并通过详细的输出与采样设置生成 Wan 2.1 视频。
以 AI 精准迁移动作,快速生成稳定流畅的角色动画。
使用 Wan 2.2 Plus 根据提示词生成 5 秒视频,并设置尺寸、随机种子和提示词扩展。
根据必填提示词生成 5 秒或 10 秒视频。可添加选填 WAV/MP3 音频、反向提示词,并从 13 种输出尺寸中选择。
根据必填提示词将一张必填的参考图像制作成视频。可设置输出尺寸、帧数、播放帧率、随机种子、步数、引导强度和 shift。
请提供 image_url 和文字 prompt。图片支持 PNG、JPEG、WebP 和 AVIF;提示词可描述运动、镜头方式、场景变化和声音需求。
duration 可选 6、8、10、12、14、16、18 或 20 秒;resolution 可选 1080p、1440p 或 2160p;aspect_ratio 仅支持 16:9;fps 可选 25 或 50。
duration 为 12、14、16、18 或 20 时,必须使用 1080p 的 resolution 和 25 的 fps。这是模型 schema 中明确列出的限制。
generate_audio 是布尔值,默认值为 true。不需要生成音频时设为 false;用于正式制作前,请检查返回的媒体内容。
本页面没有提供经过验证的速度、延迟或质量对比。可另行查看 Pro Image-to-Video,并用有代表性的输入测试两个工作流。
可以把生成的视频作为独立 LTX 2 Retake Video 工作流的源输入。请遵守该模型页面列出的输入 schema 与限制。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





