AI驱动的图像与文本转视频工具,为创作者提供灵活高效的视觉创作体验
这是快手 O3 系列中以参考素材驱动的视频生成模型,可在创作新视频时保留参考人物、道具或风格的身份特征。Standard 版本以实用价格为目标,并在完整的 3–15 秒范围内保持 O3 视觉风格。
它适合希望用特定角色、品牌元素或美术方向制作短视频,又不想组织拍摄、搭建绿幕或手工转描的团队。
AI驱动的图像与文本转视频工具,为创作者提供灵活高效的视觉创作体验
轻松将图片生成高品质动态视频,展现真实光影与自然运动效果。
结合必填的人像图片、参考视频和提示词,生成表情与动作自然的人像动画。
Dreamina 3.0助力设计师快速将文字创意变为动态真实画面,轻松打造高质量视频内容。
将静态图片快速生成高质量2K动态视频,精准还原创意细节,助力设计与视觉表达。
Seedance 2.5 1080p Text to video:从 Prompt 直出 1080p 电影级短片
Kling Video O3 Standard Reference to Video 是快手 O3 系列中以参考素材驱动的视频生成模型。它会根据提示词生成 3–15 秒视频,同时保留参考图像中的人物、道具或风格身份;也可加入参考视频引导动作或风格。输出无需手工遮罩或合成,也能在各帧间保持角色与视觉一致。
可以添加角色、道具或美术风格的参考图像,也可提供一段参考视频进行动作或风格迁移。不使用参考视频时最多支持 7 张图;使用参考视频时最多 4 张。在提示词中按位置指明图像,例如“图 1 走向图 2”,Kling Video O3 Standard Reference to Video 就能判断各主体的角色与位置。
与 Pro Reference to Video 相比,Kling Video O3 Standard Reference to Video 在保留 O3 视觉语言的同时提供更低的每秒价格,适合迭代及较大批量社交或营销内容。根据现有提供方信息,Pro 主要面向最终成片的顶级保真度,Standard 则适合草稿、变体和短内容。提示词、参考素材、宽高比、时长、音频与镜头类型等控制方式一致,可直接迁移。
社交内容创作者、广告与营销团队、电商视频制作人和设计工作室,可用 Kling Video O3 Standard Reference to Video 根据现有照片生成角色一致、场景或道具不同的视频,无需重拍。它也适合品牌代言人内容、美术方向概念短片和多角色叙事;开发者则可把简报与几张静帧自动转成完整短视频。
模型必须提供提示词,参考图像和参考视频可选但建议使用。图像最多 7 张;搭配参考视频时最多 4 张。aspect_ratio 支持 16:9、9:16、1:1,duration 为 3–15 秒整数,shot_type 接受 customize 或 intelligent,sound 与 keep_original_sound 为布尔值。分辨率和格式等其他限制可能随提供方变化,请以 RunComfy 参数面板为准。
可以。先在 RunComfy AI Playground 网页界面中调整 Kling Video O3 Standard Reference to Video 的参考素材、提示词、宽高比、时长与音频开关,再以完全相同的参数调用 RunComfy API。浏览器负责创意迭代,代码负责生产运行,模型行为保持一致。
任务会从 RunComfy 余额中扣除美元积分。根据现有提供方信息,Kling Video O3 Standard Reference to Video 无声时每秒 $0.084,有声时每秒 $0.112;提供参考视频后则改为 1.5 倍费率,即每秒 $0.126,并覆盖音频倍率。例如 5 秒无声约 $0.420,10 秒有声约 $1.120,15 秒含参考视频约 $1.890。最新费率请以模型页面 Generation 区域为准。
Kling Video O3 Standard Reference to Video 更适合明确、具体的提示词:先用“图 1”“图 2”等位置把参考素材绑定到角色,再描述动作、环境和摄影机运动。“slow tracking shot”“golden hour rim light”“neon-lit street”等具体提示,比模糊情绪词更能锁定画面与动作。复杂场景可用 multi_prompt 分隔节拍,保持一次生成中的转场干净。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





