logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Kling Lipsync: sincronizar texto e voz com vídeo | RunComfy

kling/kling/lipsync/text-to-video

Transforme texto em voz com uma Voice ID e sincronize-o com um vídeo existente.

Aceita `.mp4` e `.mov`, até 100 MB, 2–10 segundos, 720p ou 1080p, com largura e altura de 720–1920 pixels.
Texto para gerar a voz e o lipsync; máximo de 120 caracteres.
Voice ID usada para a síntese de voz.
Idioma correspondente à Voice ID: `zh` ou `en`.
Velocidade da fala de 0,8 a 2.
Idle
The rate is $0.025 per second.

Kling Lipsync com texto e voz selecionável

Esta variante do Kling Lipsync transforma texto em voz com a Voice ID escolhida e a sincroniza com um vídeo existente. Vídeo, texto e Voice ID são obrigatórios. Idioma e velocidade também podem ser configurados.

Kling Lipsync no X: trabalhos da comunidade

Entradas e opções#

  • video_url, text e voice_id são obrigatórios.
  • O vídeo deve ser .mp4 ou .mov, ter no máximo 100 MB e durar de 2 a 10 segundos. São aceitos 720p ou 1080p e largura e altura de 720–1920 pixels.
  • text aceita no máximo 120 caracteres.
  • voice_id oferece 27 valores fixos; o padrão é genshin_vindi2.
  • voice_language oferece zh e en; o padrão é en.
  • voice_speed varia de 0,8 a 2; o padrão é 1.

Voice ID disponíveis#

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1


Fluxo recomendado#

Escolha uma Voice ID e o idioma correspondente, mantenha o texto dentro de 120 caracteres e ajuste a velocidade à duração do vídeo. Use frases curtas e bem pontuadas. Confira início de frases, pausas, sílabas rápidas e movimentos da cabeça.


Esta variante não contém um campo para enviar seu próprio arquivo de áudio.

Modelos relacionados

ace-step/audio-inpaint

Edite com precisão um segmento de uma faixa de áudio sem alterar o restante.

wan-2-6/video-to-video

Crie um vídeo a partir de um prompt de texto e de um a três clipes de referência, com controles de duração, tamanho de saída, estrutura da cena, semente, prompt negativo e geração de áudio.

ltx-2-19b/video-to-video/lora

Transformação de vídeo eficiente com movimento cinematográfico e precisão de design.

ltx-2/pro/text-to-video

Gere um vídeo a partir de um prompt obrigatório com 6, 8 ou 10 segundos, de 1080p a 2160p, 25 ou 50 FPS, proporção 16:9 fixa e áudio gerado opcional.

happyhorse-1.0/video-edit

HappyHorse 1.0 Video Edit no Alibaba edita um vídeo de entrada com instruções de texto e imagens de referência para transferência de estilo, substituição local e troca de roupas.

ai-avatar/v2/standard

Transforme um retrato e uma trilha de áudio em um vídeo de avatar falante, com um prompt opcional para orientar movimento ou modo de falar.

Perguntas Frequentes

O que esta variante do Kling Lipsync faz?

Ela gera voz a partir de texto e a sincroniza com um vídeo existente.

Quais entradas são obrigatórias?

video_url, text e voice_id são obrigatórios.

Quais requisitos se aplicam ao vídeo?

Ele deve ser .mp4 ou .mov, ter no máximo 100 MB, durar 2–10 segundos, ser 720p ou 1080p e medir 720–1920 pixels de largura e altura.

Qual é o limite do texto?

text aceita no máximo 120 caracteres.

Quais Voice ID estão disponíveis?

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1

Qual é a Voice ID padrão?

O valor padrão é genshin_vindi2.

Quais idiomas podem ser escolhidos?

voice_language oferece zh e en; o padrão é en.

Qual é o intervalo de velocidade?

voice_speed varia de 0,8 a 2; o padrão é 1.

Posso enviar meu próprio arquivo de áudio?

Não. Esta variante não contém um campo de URL de áudio.

Como devo preparar o texto?

Use frases curtas e bem pontuadas e escolha uma velocidade adequada à duração do vídeo.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.

Exemplos criados com o Kling Lipsync

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...