Hailuo 2.3 让设计师轻松将静态图像转换为逼真动态视频,精准控制每一帧细节,激发创意灵感。
Kling Avatar V2 通过两项必填媒体输入生成口播数字人视频:人像决定画面中的人物,音频驱动说话表现。你还可以填写可选提示词,对表情、头部动作或表达方式作简短补充。
这个 RunComfy 页面只提供 image、audio 和 prompt 三个输入字段,没有单独的视频时长、宽高比或分辨率设置。
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| image | string (image_uri) | 必填 | 用于创建数字人的人像 URL。 |
| audio | string (audio_uri) | 必填 | 用于驱动数字人说话表现的音频 URL。 |
| prompt | string | 可选; 默认: 空; 最多 2500 个字符 | 对动作、表情或表达方式的简短说明。 |
prompt 应简短明确,只描述需要影响的行为,例如“语气沉稳”或“轻微点头”。建议先在 RunComfy 模型界面中共同检查人像、音频和可选提示词。接入应用时,可通过 Kling Avatar V2 API 端点 提交相同的三个字段。
正式使用前,请查看当前的模型提供方与 RunComfy 条款,并确认你对人像、音频、提示词及生成视频拥有必要权利。
如需其他服务版本,可查看 Kling AI Avatar V2 Pro 模型。
Hailuo 2.3 让设计师轻松将静态图像转换为逼真动态视频,精准控制每一帧细节,激发创意灵感。
专业级参考图生视频,支持 3–15s 输出,每秒 $0.112 起。
电影感 4K 参考图生视频,输出每秒 $0.42。
使用必填音频驱动一段短视频,并控制情绪、编辑范围、音视频时长不一致时的处理方式和表现力。
将静态图变成动作自然、对白同步且创作可控的逼真视频场景。
使用提示词编辑参考视频,可加入元素与图片参考,并可选择保留原始音轨。
是否可以商用取决于当前的模型提供方与 RunComfy 条款,以及你对人像、音频、提示词和生成结果所拥有的权利。通过 RunComfy 使用模型并不会取代这些条款,也不会自动授予第三方素材的使用权。发布或变现前,请先核对适用条款。
页面要求提供一个 image URL 和一个 audio URL。prompt 为可选项,最多 2500 个字符。本页面没有独立的时长、宽高比、分辨率或多参考图输入。
先在 RunComfy 模型界面中测试必填的 image、audio 以及可选的 prompt,再通过模型的 HTTP API 提交相同字段。请确保媒体 URL 在整个处理期间可访问,并在应用中妥善处理任务状态、失败情况和返回结果。
这个页面面向音频驱动的口播数字人工作流:一张人像确定出镜人物,一段音频驱动说话表现,可选提示词用于补充行为要求。它不是多图编辑工具,也不是纯文本生成视频的界面。
本页面没有承诺固定的免费试用额度。积分、价格和账号资格可能变化,开始正式任务前请以 RunComfy 账号中显示的最新信息为准。
schema 只明确 image 使用 image_uri、audio 使用 audio_uri,并未逐一列出所有兼容扩展名。请使用当前界面接受的格式并提供可直接访问的 URL;如果文件被拒绝,可转换为常见的网页图片或音频格式后重试。
如对请求、积分或 API 接入有疑问,可发送邮件至 hi@runcomfy.com 联系 RunComfy。请附上相关任务 ID 和简要问题说明,但不要通过邮件发送私密素材或登录凭据。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。