logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Kling Video O3 Standard Image To Video:在模型页面与 API 上生成电影感图像视频 | RunComfy

kling/kling-video-o3/standard/image-to-video

使用 Kling Video O3 Standard Image To Video,将一张静态图像制作成 3–15 秒电影感视频,通过提示词控制动作并可选择同步音频;可在 RunComfy 模型页面与 HTTP API 中使用。

要生成动态效果的首帧图片。请提供清晰、光线良好的照片或渲染图公开 URL。
描述视频中需要的运动、镜头移动、光线和动作。
可选结束帧,用于引导视频从起始图片平稳过渡到该图片。
生成视频的长度(3–15 秒)。
启用后将为视频合成同步音频,每秒费用约增加 33%。
编辑范围。intelligent 自动决定节奏与剪切;customize 根据提示词进行手动控制。
用于引导场景转换和情节推进的附加提示词片段。multi_prompt 中各片段时长之和必须等于视频总时长。
Idle
The rate is $0.084 per second without sound, and $0.112 per second with sound.

Kling Video O3 Standard Image To Video 简介

快手的 Kling Video O3 Standard Image To Video 可根据一张静态图像和提示词生成 3–15 秒电影感视频:无声时每秒 $0.084,有声时每秒 $0.112。

它用一次有参考引导的生成取代重新拍摄、手工关键帧和逐帧编辑,让社交内容创作者、广告团队、电商制作人与产品设计师获得尊重源画面主体的自然动作。

开发者既可在浏览器中使用 RunComfy 上的 Kling Video O3 Standard Image To Video,也可通过 HTTP API 调用,无需自行托管模型或扩展算力。

适用场景:动态产品镜头 | 社交短视频 | 分镜首尾帧转场

Kuaishou / Kling Video O3 Standard Image To Video#


这是快手 O3 系列中价格更实用的图像转视频模型,可在保留源图主体和场景的同时让参考帧动起来。Standard 版本在完整的 3–15 秒范围内,以易于接受的每秒价格兼顾出色画质。


它适合需要把现有照片、渲染图或概念图制作成短视频,又不想组织拍摄、手工设置关键帧或后期转描的团队。


核心亮点#


  • Standard 价格的 O3 品质:以 Pro 版本的一部分价格获得最新 O3 架构的动作与画面表现。
  • 灵活时长:可按整秒设置 3–15 秒,适合开场钩子、场景节拍或完整短视频。
  • 首尾帧引导:添加可选 end_image,便可控制两个画面之间的转场。
  • 可选同步音频:启用 sound 后可随画面生成环境声和音效。
  • 提示词镜头控制:intelligent 由模型自动决定范围;customize 则更严格地遵循提示词。
  • 公开 URL 输入:可直接使用任何提供干净 HTTPS URL 的存储图像,代码中无需另行上传。

参数#


参数必填类型默认值范围 / 选项说明
image*是(*)string—公开 URL要制作动画的起始帧。
prompt*是(*)string—自由文本描述动作、镜头、光线和行为。
end_image否string—公开 URL用于控制首尾两帧转场的可选结束画面。
duration否integer53–15视频时长,单位为秒。
sound否booleanfalsetrue / false合成同步音频,费率约增加 33%。
shot_type否stringcustomizecustomize、intelligent镜头范围;intelligent 自动决定,customize 遵循提示词。

价格#


模型在 RunComfy 上按生成输出的秒数计费。启用音频后,会在整段视频的基础费率上增加约 33%。


输出模式每秒费率
无声视频$0.084
有声视频$0.112

费用估算示例


时长无声有声
3 秒约 $0.252约 $0.336
5 秒(默认)约 $0.420约 $0.560
10 秒约 $0.840约 $1.120
15 秒约 $1.260约 $1.680

相关模型

runway-gen-4/turbo/image-to-video

精准匹配文本提示,生成动作真实、结构连贯的视频内容

hailuo-2-3/standard/image-to-video

Hailuo 2.3 让设计师轻松将静态图像转换为逼真动态视频,精准控制每一帧细节,激发创意灵感。

wan-2-2/lora/text-to-image

根据提示词生成图像,并设置 LoRA、图像尺寸、格式、推理步数、负面提示词和随机种子。

ltx-2-19b/video-to-video/lora

以电影级动作表现和精细创作控制,高效转换现有视频。

sora-2/pro/image-to-video

使用 Sora 2 Pro 根据提示词让参考图动起来,并选择输出尺寸和时长。

pika-2-2/text-to-video

使用 Pika 2.2 根据文本提示词生成高质量视频。

常见问题

Kling Video O3 Standard Image To Video 是什么?它能做什么?

Kling Video O3 Standard Image To Video 是快手 O3 系列中价格更实用的图像转视频模型。它会根据文本提示词,将一张参考图像制作成 3–15 秒视频,并支持可选尾帧引导与同步音频。模型在增加自然动作、摄影机运动和场景动态的同时,保持输入画面的主体身份。

Kling Video O3 Standard Image To Video 与 O3 Pro 版本有何不同?

两者共享 O3 视觉语言,但 Kling Video O3 Standard Image To Video 的每秒价格更低,适合迭代、草稿以及大批量社交或营销内容。根据现有提供方信息,Pro 版本面向最终成片的顶级保真度。提示词结构、时长范围、音频选项和镜头类型控制方式一致,因此提示词可以直接迁移。

Kling Video O3 Standard Image To Video 接受哪些输入和控制项?

需要提供起始帧图像,以及描述动作、摄影机和行为的提示词。可选项包括用于首尾两帧转场的结束图、3–15 秒时长、同步音频开关、customize 或 intelligent 的 shot_type,以及串联场景片段的 multi_prompt。Kling Video O3 Standard Image To Video 可在一次生成中灵活控制节奏、叙事节点和音频。

哪些团队和生产场景最适合 Kling Video O3 Standard Image To Video?

社交内容创作者、广告与营销团队、电商视频制作人和产品设计师,可用 Kling Video O3 Standard Image To Video 将产品图、肖像或概念图制作成电影感短视频。它也适合在投入高价最终渲染前先制作原型,以及生成分镜式首尾帧转场;开发者则可把图像与简报自动转成完整短视频。

使用 Kling Video O3 Standard Image To Video 前需要了解哪些输入限制?

image 与 prompt 都是必填项。duration 为 3–15 秒整数,默认 5 秒;sound 为布尔值且默认关闭;shot_type 接受 customize 或 intelligent。multi_prompt 是用于引导场景转场的可选列表,end_image 是可选 URL。分辨率和格式等其他限制可能随提供方设置变化,请以当前 RunComfy 参数面板为准。

开发者能否通过 RunComfy API 使用 Kling Video O3 Standard Image To Video?

可以。先在 RunComfy AI Playground 网页界面中调整 Kling Video O3 Standard Image To Video 的起始图、提示词、时长、音频和镜头类型,再以完全相同的参数调用 RunComfy API。浏览器负责创意迭代,代码负责生产运行,两种方式的模型行为一致。

在 RunComfy 上使用 Kling Video O3 Standard Image To Video 需要多少费用?

任务会从 RunComfy 余额中扣除美元积分。根据现有提供方信息,Kling Video O3 Standard Image To Video 无声时每秒 $0.084,有声时每秒 $0.112。例如 5 秒无声约 $0.420,10 秒有声约 $1.120,15 秒无声约 $1.260。新用户通常会获得免费试用美元额度;最新费率请以模型页面 Generation 区域为准。

Kling Video O3 Standard Image To Video 适合使用怎样的提示词?

Kling Video O3 Standard Image To Video 更适合清晰、有电影镜头感的提示词,具体描述动作、摄影机、光线与环境。“slow tracking shot”“golden hour rim light”“rain on neon-lit street”等具体提示,比模糊情绪词更能锁定画面与动作。复杂场景可用 multi_prompt 分隔节拍;需要精确的两帧动作弧线时,请设置 end_image。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Kling Video O3 Standard Image To Video 示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...