logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Kling O1 参考图生视频:图片与元素控制 | RunComfy

kling/kling-video-o1/image-to-video/reference

使用按顺序编号的图片与元素标记生成参考引导视频,可选择 5 秒或 10 秒时长以及 3 种精确宽高比。

必填指令。请按数组顺序将图片写作 `@Image1`、`@Image2`,将元素写作 `@Element1`、`@Element2`,并严格保持标记拼写。
Image 1
必填的附加参考图片 URL 数组。数组可以为空,最多包含 7 项。
元素 #1
元素的正面图像(主视图)。最大文件大小:10.0MB,最小宽度:300px,最小高度:300px,最小长宽比:0.40,最大长宽比:2.50,超时:20.0s
Image 1
来自不同角度的附加参考图像。支持 1-4 张图像。至少需要一张图像。
必填的角色或物体定义数组。数组可以为空,最多包含 7 个元素。
视频时长(秒),精确字符串值为 `5`、`10`。
视频宽高比,精确支持 `16:9`、`9:16`、`1:1`。
Idle
The rate is $0.112 per second.

Kling O1 参考图生视频简介

Kling O1 参考图生视频使用必填的 `prompt`、必填 `image_urls` 数组和必填 `elements` 数组。请按照数组顺序,将图片写作 `@Image1`、`@Image2` 等,将元素写作 `@Element1`、`@Element2` 等。两个数组的顶层项目数都可为 0~7。`duration` 精确支持字符串值 `5` 和 `10`,`aspect_ratio` 支持 `16:9`、`9:16`、`1:1`。当前 schema 没有参考视频、音频、分辨率、随机种子或输出格式字段。

Kling O1 参考图生视频概览#


此页面使用必填的 prompt、image_urls 数组和 elements 数组生成视频,不接收参考视频。请让每个数组的顺序与 @Image1、@Element1 等精确提示词标记一一对应。


输入与参数#


参数必填默认值 / 限制作用
prompt是示例提示词描述运动与场景。请严格拼写 @Image1、@Image2、@Element1、@Element2,并按数组顺序对应。
image_urls是0~7 项用于风格或外观的附加参考图片。字段必填,但数组可以为空。
elements是0~7 项角色或物体定义。字段必填,但数组可以为空。
duration否默认 5精确字符串值:5、10。
aspect_ratio否默认 16:9精确值:16:9、9:16、1:1。

元素结构#


elements 中的每一项可以包含:


  • frontal_image_url:元素的正面主视图。schema 描述列出的限制为:最大 10 MB、宽度和高度至少 300 像素、宽高比范围 0.40~2.50、超时时间 20 秒。
  • reference_image_urls:元素的其他角度参考图,每个元素需要 1~4 个图片 URL。

image_urls 与 elements 的描述还指出:元素、参考图和起始图合计最多 7 项。为符合这项文档限制,请保持参考集合精简。


推荐流程#


  1. 将参考图片加入 image_urls,将角色或物体定义加入 elements。
  2. 在 prompt 中按从 1 开始的准确顺序引用各项:@Image1、@Image2、@Element1、@Element2。
  3. 描述预期动作、构图以及需要保持不变的细节。
  4. 将 duration 设为 5 或 10,再从 16:9、9:16、1:1 中选择 aspect_ratio。
  5. 仔细检查结果;当前 schema 不保证身份、运动、镜头或风格保真度。

范围与限制#


  • 这是图片与元素参考工作流,不是参考视频工作流。
  • 页面没有分辨率、音频、反向提示词、随机种子、帧率、镜头或输出格式参数。
  • 当前 schema 没有说明顶层 image_urls 接受哪些图片格式。
  • 使用 @ImageN 和 @ElementN 时,标记拼写与数组顺序都很重要。

相关模型#


Kling O1 Video Edit

相关模型

gemini-omni-flash/reference-to-video

根据参考图像和提示词生成带同步音频的短视频。

lucy-edit/restyle

通过文字指令重塑现有视频,同时尽量保留源视频的动作与整体构图。

infinite-talk/fast/multi

使用两段音频和一张图片生成视频,并设置两位人物的发言顺序。

sora-2/image-to-video

Sora 2 轻松将图像转化为逼真视频,视觉与音频自然同步,激发创意灵感。

kling-1-6/pro/image-to-video

精准理解提示,流畅生成动画,高品质图像到视频创作体验。

wan-2-2/lora/image-to-video

根据提示词让起始图像动起来,并设置 LoRA、帧数、FPS、分辨率、宽高比、推理步数和随机种子。

常见问题

Kling O1 参考图生视频是什么?

这是一个由参考内容引导的视频页面,使用必填的 prompt、必填 image_urls 数组和必填 elements 数组,不接收参考视频。

如何在提示词中引用图片和元素?

请按数组顺序使用从 1 开始的精确标记:image_urls 对应 @Image1、@Image2 等,elements 对应 @Element1、@Element2 等。不要翻译或改写标记。

image_urls 和 elements 都必填吗?

是。两个字段都在 required 列表中,但各自的 minItems 均为 0,因此即使数组为空,字段本身仍需存在。

参考内容有哪些数量限制?

image_urls 顶层可包含 0~7 项,elements 可包含 0~7 个元素。字段描述还指出,元素、参考图和起始图合计最多 7 项。

每个元素包含什么?

元素可包含作为主视图的 frontal_image_url,以及包含 1~4 个其他视图的 reference_image_urls。正面图片描述列出的限制为最大 10 MB、宽高均至少 300 像素、宽高比 0.40~2.50。

支持哪些时长和宽高比?

duration 使用精确字符串值 5、10,默认值为 5;aspect_ratio 精确支持 16:9、9:16、1:1,默认值为 16:9。

可以上传参考视频或保留音频吗?

不能。页面没有参考视频或音频字段,因此当前 schema 不支持有关视频输入、保留原音频或生成音频的说法。

这个模型如何计费?

RunComfy 通过当前积分系统管理用量。实际积分消耗请查看生成面板或最新计费文档;当前 schema 不保证提供免费试用积分。

可以选择哪些输出分辨率和格式?

当前 schema 没有分辨率或输出格式选择器,也没有帧率、随机种子、反向提示词或专用镜头参数。

主要限制有哪些?

结果依赖参考内容的顺序和标记的精确拼写。当前 schema 没有公布身份、风格、镜头、运动、时序一致性或输入格式方面的基准与保证。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • Wan 2.6 Flash
  • Wan 2.6 Text to Video
  • Hailuo 2.3 Fast Standard
  • Happy Horse 1.1 reference to video
  • Seedance 2.5 Reference to Video
  • Seedance 2.0 Pro
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • seedream 4.0
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • GPT Image 2 Image Edit
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

更多示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...