智能文本转视频工具,支持1080p高质量生成,轻松打造生动镜头与真实情感,激发创作灵感。
Kling Avatar V2 通过两项必填媒体输入生成口播数字人视频:人像决定画面中的人物,音频驱动说话表现。你还可以填写可选提示词,对表情、头部动作或表达方式作简短补充。
这个 RunComfy 页面只提供 image、audio 和 prompt 三个输入字段,没有单独的视频时长、宽高比或分辨率设置。
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| image | string (image_uri) | 必填 | 用于创建数字人的人像 URL。 |
| audio | string (audio_uri) | 必填 | 用于驱动数字人说话表现的音频 URL。 |
| prompt | string | 可选; 默认: 空; 最多 2500 个字符 | 对动作、表情或表达方式的简短说明。 |
prompt 应简短明确,只描述需要影响的行为,例如“语气沉稳”或“轻微点头”。建议先在 RunComfy 模型界面中共同检查人像、音频和可选提示词。接入应用时,可通过 Kling Avatar V2 API 端点 提交相同的三个字段。
正式使用前,请查看当前的模型提供方与 RunComfy 条款,并确认你对人像、音频、提示词及生成视频拥有必要权利。
如需其他服务版本,可查看 Kling AI Avatar V2 Pro 模型。
每秒 $0.055。
智能文本转视频工具,支持1080p高质量生成,轻松打造生动镜头与真实情感,激发创作灵感。
MiniMax H3 Max text to video:带有本机音频的 480p/768p 剪辑
将驱动视频中的动作迁移到参考角色图片,并可设置正向/反向提示词和生成参数。
使用Veo 3.1 Fast轻松将图片或文字转化为高质量电影级视频,创作高效灵活。
通过文字指令重塑现有视频,同时尽量保留源视频的动作与整体构图。
Veo 3.1 帮助设计师快速将图像转换为高质量动态视频,创作流畅又真实的视觉作品。
是否可以商用取决于当前的模型提供方与 RunComfy 条款,以及你对人像、音频、提示词和生成结果所拥有的权利。通过 RunComfy 使用模型并不会取代这些条款,也不会自动授予第三方素材的使用权。发布或变现前,请先核对适用条款。
页面要求提供一个 image URL 和一个 audio URL。prompt 为可选项,最多 2500 个字符。本页面没有独立的时长、宽高比、分辨率或多参考图输入。
先在 RunComfy 模型界面中测试必填的 image、audio 以及可选的 prompt,再通过模型的 HTTP API 提交相同字段。请确保媒体 URL 在整个处理期间可访问,并在应用中妥善处理任务状态、失败情况和返回结果。
这个页面面向音频驱动的口播数字人工作流:一张人像确定出镜人物,一段音频驱动说话表现,可选提示词用于补充行为要求。它不是多图编辑工具,也不是纯文本生成视频的界面。
本页面没有承诺固定的免费试用额度。积分、价格和账号资格可能变化,开始正式任务前请以 RunComfy 账号中显示的最新信息为准。
schema 只明确 image 使用 image_uri、audio 使用 audio_uri,并未逐一列出所有兼容扩展名。请使用当前界面接受的格式并提供可直接访问的 URL;如果文件被拒绝,可转换为常见的网页图片或音频格式后重试。
如对请求、积分或 API 接入有疑问,可发送邮件至 hi@runcomfy.com 联系 RunComfy。请附上相关任务 ID 和简要问题说明,但不要通过邮件发送私密素材或登录凭据。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。