根据驱动视频中的动作,让参考图片动起来。
Kling O1 Video to Video Edit 在保留源视频动作与构图信息的基础上修改画面。prompt 用来说明哪些内容需要保留、哪些内容需要改变;可选的 elements 与 image_urls 可按顺序补充人物、物体、外观或风格参考。
本端点只提供 prompt、video_url、keep_audio、image_urls 和 elements,没有单独的 aspect_ratio、duration 或输出分辨率控制。
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| prompt | string | 必填;已预填示例 | 主要编辑指令。使用 @Element1、@Element2 和 @Image1、@Image2 按位置引用对应条目。 |
| video_url | string (video_uri) | 必填;.mp4/.mov;3–10 秒;720p–2160p 输入;≤200 MB | 用于引导动作与构图的源视频。 |
| keep_audio | boolean | 可选;默认 false | 设为 true 时保留输入视频的原始音轨;设为 false 时请求静音输出。 |
| image_urls | array of strings (image_uri) | 必填;0–4 项;已预填 1 个示例 | 按顺序排列的外观或风格参考图。 |
| elements | array | 必填;0–7 项;已预填 1 个元素示例 | 按顺序排列的人物或物体条目,在提示词中以 @ElementN 引用。 |
每个 elements 条目包含:
| 字段 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| frontal_image_url | string (image_uri) | 默认空;≤10.0 MB;至少 300 × 300 px;宽高比 0.40–2.50;超时 20.0 秒 | 元素的主要正面图片。 |
| reference_image_urls | array of strings (image_uri) | 1–4 项;至少 1 项 | 同一元素的其他角度参考图。 |
schema 允许 elements 最多 7 项、image_urls 最多 4 项。字段说明还要求,视频请求中的元素与参考图合计不得超过 4 个。发送请求前应同时检查各数组上限和合计上限。
@Element1、@Element2 等标记引用 elements 中的条目。@Image1、@Image2 等标记引用 image_urls 中的条目。keep_audio 设为 true。先在 RunComfy 模型界面中一起测试源视频、参考内容和提示词。接入应用时,通过 Kling O1 Video to Video Edit API 发送相同字段。请求处理期间应保持所有媒体 URL 可访问,检查参考内容数量,并在应用中处理任务状态与错误。
以上媒体限制描述的是输入要求,并不保证输出分辨率或完成时间。价格、可用性与使用权以当前产品和提供方条款为准。
根据驱动视频中的动作,让参考图片动起来。
通过多模态参考、口型同步和镜头控制,更快生成具有电影感的短视频。
根据文本指令编辑源视频,同时保持场景结构与动作连贯。
通过文字指令重塑现有视频,同时尽量保留源视频的动作与整体构图。
生成 2K 电影感视频,支持精准口型同步与镜头控制。
根据必填文本提示词生成视频。可选择六种宽高比、`540p`/`720p`/`1080p`、`5` 秒/`9` 秒,以及是否循环播放。
商业使用取决于当前模型提供方和 RunComfy 的条款,以及你对源视频、音频、提示词、参考图和输出内容拥有的权利。本页面没有声明不受限制的许可授权。发布或变现结果前,请查阅适用条款。
使用行为受当前模型提供方与平台条款约束。通过 RunComfy 获得托管访问不会取代这些条款,也不会转让第三方视频、音频或图片的权利。请查看你所用接入渠道的最新条款。
不保证。本页面没有记录固定完成时间或吞吐量。处理时间可能受源视频、参考内容数量、服务负载和账号限制影响。请在自己的工作流中测试有代表性的请求,并处理异步任务状态与失败情况。
源视频支持 .mp4 或 .mov、3–10 秒、720p–2160p 输入,文件最大 200 MB。image_urls 接受 0–4 项,elements 接受 0–7 项。字段说明还要求视频请求中的元素与参考图合计不超过 4 个。每个元素包含一个 frontal_image_url 和 1–4 个 reference_image_urls。
先在 RunComfy 模型界面中验证相同的 prompt、video_url、keep_audio、image_urls 和 elements。然后通过模型 API 发送这些字段,保持媒体 URL 可访问,检查数组与合计数量限制,并在应用中处理任务状态与错误。
使用相同的源视频、提示词、参考内容和评估标准,比较动作保留、编辑准确度、主体一致性、构图与音频处理。本页面没有提供经过验证的基准,也没有声明它在质量上普遍优于其他模型。
本页面只记录通过 RunComfy 浏览器界面和 HTTP API 使用模型的方式,没有提供可下载权重、本地安装步骤或硬件要求。不要因为可以托管访问就假设模型支持本地部署。
本页面不承诺免费额度或固定价格。额度、价格、可用性与账号限制都可能变化;规划用量前,请查看 RunComfy 账号中显示的当前信息。
确认视频和图片 URL 可以直接访问,源视频符合格式与大小要求,参考数组没有超出限制,并且每个 @ElementN 或 @ImageN 都对应实际条目。如果问题持续,请将任务 ID 和简要错误说明发送至 hi@runcomfy.com;不要通过电子邮件发送私密媒体或登录凭据。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





