根据必填提示词将一张必填的参考图像制作成视频。可设置输出尺寸、帧数、播放帧率、随机种子、步数、引导强度和 shift。
Kling O1 Reference Video to Video 根据现有视频生成新镜头。源视频提供画面与动作上下文,prompt 用来说明如何续写或变换;可选的 elements 与 image_urls 可按顺序补充主体、物体、外观或风格参考。
与编辑端点相比,本页面还提供 aspect_ratio 和 duration。宽高比可选 auto、16:9、9:16 或 1:1;时长是字符串,可选值为 5 或 10。
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| prompt | string | 必填;已预填示例 | 主要指令。使用 @Element1、@Element2 和 @Image1、@Image2 按位置引用对应条目。 |
| video_url | string (video_uri) | 必填;.mp4/.mov;3–10 秒;720–2160 px 输入;≤200 MB | 用于生成新镜头的源视频。 |
| keep_audio | boolean | 可选;默认 false | 设为 true 时保留源视频原始音轨;设为 false 时请求静音输出。 |
| image_urls | array of strings (image_uri) | 必填;0–4 项;已预填 1 个示例 | 按顺序排列的外观或风格参考图。 |
| elements | array | 必填;0–7 项;已预填 1 个元素示例 | 按顺序排列的人物或物体条目,在提示词中以 @ElementN 引用。 |
| aspect_ratio | string | 可选;默认 auto;选项:auto、16:9、9:16、1:1 | 生成视频的画面比例。 |
| duration | string | 可选;默认 "5";选项:"5"、"10" | 请求的输出时长。 |
每个 elements 条目包含:
| 字段 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| frontal_image_url | string (image_uri) | 默认空;≤10.0 MB;至少 300 × 300 px;宽高比 0.40–2.50;超时 20.0 秒 | 元素的主要正面图片。 |
| reference_image_urls | array of strings (image_uri) | 1–4 项;至少 1 项 | 同一元素的其他角度参考图。 |
schema 允许 elements 最多 7 项、image_urls 最多 4 项。字段说明还要求,视频请求中的元素与参考图合计不超过 4 个。应同时检查各数组和合计数量。
@Element1、@Element2 等标记引用 elements 中的条目。@Image1、@Image2 等标记引用 image_urls 中的条目。aspect_ratio 只能使用 auto、16:9、9:16 或 1:1。duration 必须以字符串 "5" 或 "10" 发送。keep_audio 设为 true。请使用稳定且可以直接访问的媒体 URL,并在提交请求前检查所有数量限制。源视频说明记录了 .mp4/.mov、3–10 秒、720–2160 px 和最大 200 MB;这些是输入限制,不代表对输出分辨率或延迟的保证。
你也可以在 Kling Video to Video Edit 模型 中测试相关编辑工作流。
价格、可用性与使用权以当前产品和提供方条款为准。本页面没有记录本地部署方式,也不保证提供免费额度。
根据必填提示词将一张必填的参考图像制作成视频。可设置输出尺寸、帧数、播放帧率、随机种子、步数、引导强度和 shift。
使用Veo 3.1将静态图像一键转化为逼真动态视频,轻松实现创意叙事与视觉表达。
根据文字、参考音频或图像生成自然的语音与音频。
精确重制音轨中的指定片段,其余部分保持不变。
FLUX 3 Draft Extend: 720p 的快速低成本剪辑延续草稿
使用腾讯 Hunyuan Video 根据文本提示词生成高质量视频。
它以现有参考视频为基础生成新镜头。prompt 描述续写或变换方式,可选的 elements 与 image_urls 用来引导主体、物体、外观或风格;页面还提供 aspect_ratio、duration 和 keep_audio 控制。
它通过源视频与结构化提示词引导结果,不使用由剪辑点和效果组成的手动时间线。它可用于生成相关的新镜头,但本页面没有声称它能取代完整的视频编辑软件,也不保证效果一定更好。
字段包括 prompt、video_url、keep_audio、image_urls、elements、aspect_ratio 和 duration。使用 @ElementN 与 @ImageN 将提示词关联到按顺序排列的参考内容。aspect_ratio 可选 auto、16:9、9:16 或 1:1;duration 接受字符串 5 或 10。
它适合需要根据现有视频生成新短镜头的电影创作者、广告团队、社交媒体团队、设计师和其他创作者。是否适用取决于源素材、参考内容质量、目标画面比例与音频工作流。
本页面不承诺免费使用或固定额度。价格、额度、可用性与账号限制都可能变化;规划用量前,请查看 RunComfy 账号中的当前信息。
它接受文本 prompt、一个 video_url、可选的音轨保留设置、0–4 个 image_urls 和 0–7 个 elements。源视频说明要求 .mp4/.mov、3–10 秒、720–2160 px 输入且最大 200 MB。输出 duration 是字符串 5 或 10;aspect_ratio 可选 auto、16:9、9:16 或 1:1。
本页面没有提供普遍适用的质量或速度排名。请使用相同的源视频、提示词、参考内容、宽高比、时长和评估标准进行比较,再检查连续性、指令遵循、主体一致性与输出可用性。
可以。将 keep_audio 设为 true 可请求保留源音轨;保持默认值 false 则请求静音输出。正式使用前,请在自己的工作流中确认返回结果的音频。
image_urls 接受 0–4 项,elements 接受 0–7 项。字段说明还要求,视频请求中的元素与参考图合计不超过 4 个。每个元素包含一个 frontal_image_url 和 1–4 个 reference_image_urls,并且至少需要 1 张参考图。
你可以在 RunComfy 模型界面中使用它。接入应用时,如果账号可用对应模型 API,请发送相同的 schema 字段,保持媒体 URL 可访问,检查参考内容数量和枚举值,并处理任务状态与错误。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





