输入文字即可生成短视频,并可设置时长、宽高比与是否生成音频。
Kling AI Avatar V2 Pro 要求提供数字人 image 和 audio 文件。还可以填写少于 2,500 个字符的可选 prompt,用于补充视频生成指令。
| 参数 | 必填 | 默认值 | 作用 |
|---|---|---|---|
image | 是 | 示例图片 URL | 用作数字人的单张图片 URL。schema 没有说明文件格式、尺寸或宽高比。 |
audio | 是 | 示例音频 URL | 用于生成的音频文件 URL。schema 没有说明格式、文件大小、语言或时长。 |
prompt | 否 | 空 | 可选生成指令,少于 2,500 个字符。 |
image 提供清晰的数字人图片,通过 audio 提供目标音频。prompt,说明期望的表达或画面行为。audio 是必填输入,但 schema 没有说明支持的语言或可量化的口型同步保证。输入文字即可生成短视频,并可设置时长、宽高比与是否生成音频。
使用 Kling 2.1 Pro 根据必填起始图片和提示词生成视频,并可设置选填结束图片、时长、宽高比、负面提示词和提示词强度。
使用腾讯 Hunyuan Video 将现有视频转换为新的视觉风格。
开放式文本转视频,具有 480p/768p 和原生立体声音频。
Sora 2 轻松将图像转化为逼真视频,视觉与音频自然同步,激发创意灵感。
根据必填文本提示词生成音画同步视频。输出尺寸可选 `1280x720` 或 `720x1280`,时长可选 `4`、`8` 或 `12` 秒。
这是一个数字人视频页面,要求提供 1 个 image URL 和 1 个 audio URL。可选的 prompt 必须少于 2,500 个字符,用于补充生成指令。
当前 schema 没有提供它与其他工具在动作真实感、时间连续性、镜头控制或画质方面的基准数据。能够确认的只有必填图片与音频工作流,以及可选提示词。
schema 没有定义免费档位、Pro 或 Master 定价,也没有说明如何赚取积分。实际积分消耗请查看当前 RunComfy 生成面板和计费文档。
它适合需要根据 1 张图片和 1 个音频文件生成数字人视频的创作者、营销人员、教育者和本地化团队。请仔细检查结果中的身份特征、表情、口型、构图和时序。
当前 schema 没有分辨率、帧率或时长参数,因此不能据此确认 1080p、30 fps 或任何固定最长时长。
在 RunComfy 的 Kling AI Avatar V2 Pro 页面填写已列出的字段即可。浏览器、移动端兼容性或安装要求不属于模型 schema 的定义范围。
页面接收 1 张图片、1 个音频文件和 1 个可选提示词。它没有时长、分辨率、宽高比、镜头运动、动画风格、随机种子或输出格式专用参数,也没有正式画质阈值。
audio 是必填输入,因此数字人视频由音频文件驱动。但 schema 没有说明支持的语言、声音功能、对齐指标或具体口型同步准确度保证。
页面没有宽高比或风格专用字段。你可以在可选 prompt 中描述期望效果,但 schema 不保证 16:9、9:16、1:1 等特定比例,也不保证电影感、动漫或写实等命名模式。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。