logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Kling Lipsync 文本语音与视频同步 | RunComfy

kling/kling/lipsync/text-to-video

使用所选音色朗读文本,并与现有视频同步。

支持 `.mp4` 或 `.mov`、不超过 100 MB、2–10 秒、720p 或 1080p,宽度和高度为 720–1920 像素。
用于生成语音和口型同步的文本,最多 120 个字符。
用于语音合成的音色 ID。
与音色 ID 对应的语言,可选 `zh` 或 `en`。
语音速度,可设置为 0.8–2。
Idle
The rate is $0.025 per second.

Kling Lipsync 文本语音与视频同步

此 Kling Lipsync 版本会使用所选音色 ID 将文本转换为语音,并与现有视频同步。视频、文本和音色 ID 均为必填项,还可设置语言和语速。

X 上的 Kling Lipsync 社区作品

输入项与设置#

  • video_url、text 和 voice_id 为必填项。
  • 视频必须为 .mp4 或 .mov,文件不超过 100 MB,时长为 2–10 秒。支持 720p 或 1080p,宽度和高度为 720–1920 像素。
  • text 最多 120 个字符。
  • voice_id 提供 27 个固定值,默认为 genshin_vindi2。
  • voice_language 支持 zh 和 en,默认为 en。
  • voice_speed 范围为 0.8–2,默认值为 1。

可选音色 ID#

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1


建议流程#

选择音色 ID 和对应语言,将文本控制在 120 个字符以内,并根据视频时长调整语速。建议使用简短、断句清晰的句子。请检查句子开头、停顿、快速音节和头部运动。


此版本没有上传自定义音频文件的字段。

相关模型

flux-3/text-to-video/draft

FLUX 3 Draft:快速、低成本的 720p 文本转视频预览

seedance-1-0/pro/fast/image-to-video

利用Seedance 1.0 Pro Fast轻松将静态图像变为电影级动态视频,释放创作无限可能。

video-background-removal/green-screen

移除视频背景,并根据后期流程调整输出编码与色溢抑制强度。

kling-video-o1/video-to-video/edit

使用提示词编辑参考视频,可加入元素与图片参考,并可选择保留原始音轨。

wan-2-1/text-to-video

使用 Wan 2.1 根据文本提示词生成视频,并设置分辨率、宽高比、帧数、帧率等选项。

luma-ray-2/text-to-video

根据必填文本提示词生成视频。可选择六种宽高比、`540p`/`720p`/`1080p`、`5` 秒/`9` 秒,以及是否循环播放。

常见问题

此 Kling Lipsync 版本可以做什么?

它会根据文本生成语音,并与现有视频同步。

哪些输入项是必填的?

video_url、text 和 voice_id 为必填项。

视频有什么要求?

视频必须为 .mp4 或 .mov,不超过 100 MB,时长 2–10 秒,分辨率为 720p 或 1080p,宽度和高度为 720–1920 像素。

文本长度上限是多少?

text 最多 120 个字符。

可以选择哪些音色 ID?

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1

默认音色 ID 是什么?

默认值为 genshin_vindi2。

可以选择哪些语言?

voice_language 支持 zh 和 en,默认为 en。

语速范围是多少?

voice_speed 范围为 0.8–2,默认值为 1。

可以上传自己的音频文件吗?

不可以。此版本没有音频 URL 字段。

文本应该如何准备?

使用简短、断句清晰的句子,并选择适合视频时长的语速。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Kling Lipsync 生成示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...