精准理解提示,流畅生成动画,高品质图像到视频创作体验。
这是快手 O3 系列的文字转视频模型,能够仅根据一条提示词生成电影感动作、稳定主体和符合物理规律的画面。Standard 版本在保留 O3 视觉风格的同时提供更实用的价格,并可选择生成音频,让输出视频自带完成混音的声画效果。
它适合需要快速制作符合需求的短镜头、又不想组织摄制组、使用剪辑机房或搜索授权素材的团队。
| 参数 | 必填 | 类型 | 默认值 | 范围 / 选项 | 说明 |
|---|---|---|---|---|---|
| prompt* | 是(*) | string | — | 自由文本 | 描述主体、动作、镜头和氛围的场景提示词。 |
| aspect_ratio | 否 | string | 16:9 | 16:9、9:16、1:1 | 输出画面的宽高比。 |
| duration | 否 | integer | 5 | 3–15 | 视频时长,单位为秒。 |
| sound | 否 | boolean | false | true / false | 随视频生成同步音频。 |
| shot_type | 否 | string | customize | customize、intelligent | 镜头模式;intelligent 自动决定范围,customize 遵循提示词。 |
| multi_prompt | 否 | array | — | 0–20 项 | 用于引导场景转场的附加提示词片段;片段时长之和必须等于视频总时长。 |
RunComfy 上的 Standard 版本按生成视频的秒数计费。启用音频后,会在无声费率基础上增加约 33%。
| 输出模式 | 每秒费率 |
|---|---|
| 无声视频 | $0.084 |
| 有声视频 | $0.112 |
费用估算示例
| 时长 | 无声 | 有声 |
|---|---|---|
| 3 秒 | 约 $0.252 | 约 $0.336 |
| 5 秒(默认) | 约 $0.420 | 约 $0.560 |
| 10 秒 | 约 $0.840 | 约 $1.120 |
| 15 秒 | 约 $1.260 | 约 $1.680 |
1) 在 RunComfy 中打开 Kling Video O3 模型,并展开生成面板。
2) 用镜头语言编写提示词,明确主体、动作、环境、摄影机运动和光线。
3) 按发布渠道选择宽高比:YouTube 用 16:9,Reels 和 Shorts 用 9:16,信息流用 1:1。
4) 将时长设为 3–15 秒;迭代提示词时先生成 3–5 秒,最终成片再延长。
5) 只有确实需要同步音频时才开启 sound,因为它会提高每秒费用。
6) 选择 shot_type:需要严格按提示词控制时用 customize;希望模型处理节奏时用 intelligent。
7) 运行生成、预览结果,然后从任务历史下载视频。
8) 自动化使用时,将相同字段发送到 RunComfy API 端点,并把输出 URL 接入现有流程。
精准理解提示,流畅生成动画,高品质图像到视频创作体验。
使用 Pika 2.2 从文本生成高清动画,快速实现创意视频制作。
根据参考素材生成 3–15 秒视频,起价为每秒 $0.084。
利用Wan 2.5,将静态图像高效转换为动态视频,轻松打造创意视觉内容。
HappyHorse 1.0 参考视频将多达 9 个参考图像和提示融合成一个具有稳定身份的连贯多字符剪辑。
生成 2K 电影感视频,支持精准口型同步与镜头控制。
Kling Video O3 是快手 O3 系列的文字转视频模型,可将一条提示词制作成主体稳定、动作自然且符合物理规律的电影感视频。在 RunComfy 的文字转视频流程中,只需描述场景、镜头和氛围,Kling Video O3 便会输出完成的视频,并可选择同步音频。它适合希望跳过手工剪辑和摄制组、快速通过提示词创作的用户。
Kling Video O3 适合制作社交短片、广告素材、品牌片头、产品可视化和设计或分镜概念镜头。3–15 秒灵活时长与 16:9、9:16、1:1 宽高比,可让同一模型覆盖 TikTok、Reels、YouTube 和信息流版位。需要输出自带完整声画时,还可开启可选音频。
与 O3 Pro 相比,Kling Video O3 Standard 在保留 O3 视觉风格的同时提供更实用的每秒价格,适合迭代和较大批量生成。根据现有提供方资料,与 V3.0 等早期 Kling 版本相比,O3 系列更重视动作真实感和主体一致性。提示词、宽高比、时长、音频与镜头类型等控制方式依然熟悉,旧提示词也容易迁移。
营销团队、视频剪辑师、社交内容创作者和产品设计师可用 Kling Video O3 制作符合简报的宣传片、动态情绪板和短视频,无需预约演员或搜寻素材。开发者可将同一模型接入自动化流程,把简报元数据转成可发布的视频;分镜师和概念艺术家也可更快预演原本需要预可视化制作的场景。
Kling Video O3 必须提供文本提示词,支持 16:9、9:16、1:1 宽高比,以及 3–15 秒的整秒时长。sound 可开关,shot_type 接受 customize 或 intelligent。提示词长度、多段提示词数量和渲染并发等其他限制可能随模式或提供方设置变化,请以当前 RunComfy 参数面板为准。
可以。先在 RunComfy AI Playground 网页界面中调整 Kling Video O3 的提示词、宽高比、时长、音频和镜头类型,直到结果符合目标;配置稳定后,即可以完全相同的参数从后端、内容流水线或 CMS 调用 RunComfy API。浏览器负责创意迭代,代码负责生产运行,模型行为保持一致。
Kling Video O3 会从 RunComfy 余额中扣除美元积分。根据现有提供方信息,Standard 版本无声时按每秒 $0.084 计费,有声时按每秒 $0.112 计费,启用音频约增加 33%。默认 5 秒无声视频约 $0.42,15 秒有声视频约 $1.68。新用户通常会获得免费试用美元额度;最新价格请以模型页面 Generation 区域为准。
Kling Video O3 更适合简洁、有优先级的镜头语言:先写摄影机运动和镜头类型,再说明主体、动作、环境、光线和时段。“slow push-in”“golden hour rim light”“handheld with slight sway”等具体提示,比冗长的形容词更能锁定动作与画面。生成 10–15 秒视频时,应描述一条清晰的动作弧线,避免多个无关动作破坏连贯性。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





