logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Kling AI Avatar V2 Pro:图片和音频生成数字人视频 | RunComfy

kling/ai-avatar/v2/pro

根据 1 张图片和 1 个音频文件生成数字人视频,并可添加少于 2,500 个字符的提示词。

用作数字人的图片 URL。
0:00
0:00
用于生成的音频文件 URL。
可选的视频生成指令;少于 2,500 个字符。
Idle
The rate is $0.115 per second.

Kling AI Avatar V2 Pro 简介

Kling AI Avatar V2 Pro 使用 1 张必填数字人 `image` 和 1 个必填 `audio` 文件生成数字人视频。可选的 `prompt` 可补充生成指令,且必须少于 2,500 个字符。当前 schema 没有时长、分辨率、帧率、宽高比、镜头、风格、随机种子或输出格式参数。

Kling AI Avatar V2 Pro 概览#


Kling AI Avatar V2 Pro 要求提供数字人 image 和 audio 文件。还可以填写少于 2,500 个字符的可选 prompt,用于补充视频生成指令。


输入#


参数必填默认值作用
image是示例图片 URL用作数字人的单张图片 URL。schema 没有说明文件格式、尺寸或宽高比。
audio是示例音频 URL用于生成的音频文件 URL。schema 没有说明格式、文件大小、语言或时长。
prompt否空可选生成指令,少于 2,500 个字符。

推荐流程#


  1. 通过 image 提供清晰的数字人图片,通过 audio 提供目标音频。
  2. 仅使用简洁且相互兼容的 prompt,说明期望的表达或画面行为。
  3. 发布前检查结果中的身份特征、口型、表情、构图和音频时序。

能力边界#


  • 页面没有时长、分辨率、帧率、宽高比、镜头运动、动画风格、随机种子或输出格式专用参数。
  • schema 不确认 1080p、30 fps、特定宽高比、移动端支持、免费使用,也没有说明 Standard、Pro、Master 版本差异。
  • audio 是必填输入,但 schema 没有说明支持的语言或可量化的口型同步保证。

相关模型#


Kling AI Avatar V2 Standard

相关模型

happyhorse-1.0/image-to-video

Alibaba 上的 HappyHorse 1.0 I2V 将静态图像动画化为原生 1080p 视频,具有物理精确的运动和身份稳定的主题。

video-background-removal/fast/video-to-video

使用 Fast 版本移除视频背景,并设置输出编码、边缘优化与主体类型。

ltx-2/fast/text-to-video

根据文字提示词生成 16:9 视频,可选择时长、分辨率、帧率以及是否生成音频。

kling/lipsync/audio-to-video

通过两个必填 URL,将音频轨道与现有视频同步。

pikascenes

使用 1–6 张图像组合场景,并通过 Pikascenes 将其制作成动态视频。

ai-avatar/v2/standard

使用一张人像和一段音频生成口播数字人视频,并可通过提示词引导动作与表达方式。

常见问题

Kling AI Avatar V2 Pro 是什么?

这是一个数字人视频页面,要求提供 1 个 image URL 和 1 个 audio URL。可选的 prompt 必须少于 2,500 个字符,用于补充生成指令。

Kling AI Avatar V2 Pro 与其他数字人或图生视频工具相比如何?

当前 schema 没有提供它与其他工具在动作真实感、时间连续性、镜头控制或画质方面的基准数据。能够确认的只有必填图片与音频工作流,以及可选提示词。

Kling AI Avatar V2 Pro 可以免费使用吗?

schema 没有定义免费档位、Pro 或 Master 定价,也没有说明如何赚取积分。实际积分消耗请查看当前 RunComfy 生成面板和计费文档。

这个数字人页面适合哪些用户?

它适合需要根据 1 张图片和 1 个音频文件生成数字人视频的创作者、营销人员、教育者和本地化团队。请仔细检查结果中的身份特征、表情、口型、构图和时序。

支持哪些分辨率、帧率和时长?

当前 schema 没有分辨率、帧率或时长参数,因此不能据此确认 1080p、30 fps 或任何固定最长时长。

在哪里可以使用 Kling AI Avatar V2 Pro?

在 RunComfy 的 Kling AI Avatar V2 Pro 页面填写已列出的字段即可。浏览器、移动端兼容性或安装要求不属于模型 schema 的定义范围。

主要限制有哪些?

页面接收 1 张图片、1 个音频文件和 1 个可选提示词。它没有时长、分辨率、宽高比、镜头运动、动画风格、随机种子或输出格式专用参数,也没有正式画质阈值。

它支持音频或口型同步吗?

audio 是必填输入,因此数字人视频由音频文件驱动。但 schema 没有说明支持的语言、声音功能、对齐指标或具体口型同步准确度保证。

可以选择宽高比或动画风格吗?

页面没有宽高比或风格专用字段。你可以在可选 prompt 中描述期望效果,但 schema 不保证 16:9、9:16、1:1 等特定比例,也不保证电影感、动漫或写实等命名模式。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • 查看所有模型 →
图像模型
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

更多示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...