logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Kling Lipsync: sincronizar texto e voz com vídeo | RunComfy

kling/kling/lipsync/text-to-video

Transforme texto em voz com uma Voice ID e sincronize-o com um vídeo existente.

Aceita `.mp4` e `.mov`, até 100 MB, 2–10 segundos, 720p ou 1080p, com largura e altura de 720–1920 pixels.
Texto para gerar a voz e o lipsync; máximo de 120 caracteres.
Voice ID usada para a síntese de voz.
Idioma correspondente à Voice ID: `zh` ou `en`.
Velocidade da fala de 0,8 a 2.
Idle
The rate is $0.025 per second.

Kling Lipsync com texto e voz selecionável

Esta variante do Kling Lipsync transforma texto em voz com a Voice ID escolhida e a sincroniza com um vídeo existente. Vídeo, texto e Voice ID são obrigatórios. Idioma e velocidade também podem ser configurados.

Kling Lipsync no X: trabalhos da comunidade

Entradas e opções#

  • video_url, text e voice_id são obrigatórios.
  • O vídeo deve ser .mp4 ou .mov, ter no máximo 100 MB e durar de 2 a 10 segundos. São aceitos 720p ou 1080p e largura e altura de 720–1920 pixels.
  • text aceita no máximo 120 caracteres.
  • voice_id oferece 27 valores fixos; o padrão é genshin_vindi2.
  • voice_language oferece zh e en; o padrão é en.
  • voice_speed varia de 0,8 a 2; o padrão é 1.

Voice ID disponíveis#

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1


Fluxo recomendado#

Escolha uma Voice ID e o idioma correspondente, mantenha o texto dentro de 120 caracteres e ajuste a velocidade à duração do vídeo. Use frases curtas e bem pontuadas. Confira início de frases, pausas, sílabas rápidas e movimentos da cabeça.


Esta variante não contém um campo para enviar seu próprio arquivo de áudio.

Modelos relacionados

wan-2-6/video-to-video

Crie um vídeo a partir de um prompt de texto e de um a três clipes de referência, com controles de duração, tamanho de saída, estrutura da cena, semente, prompt negativo e geração de áudio.

wan-2-2/animate/video-to-video

Crie um vídeo animado com uma imagem de referência e um vídeo de origem, escolhendo tamanho de saída e seed.

hailuo-02/image-to-video

Gere vídeos em HD com IA a partir de imagens, com movimento fluido e alta precisão

happyhorse-1.1/image-to-video

Anime uma foto estática em um vídeo fluido de 720P ou 1080P a partir de um único prompt.

kling-video-o3/4K/image-to-video

Geração cinematográfica 4K de imagem para vídeo por US$ 0,42 por segundo de saída.

fantasy-portrait/image-to-video

Transforme um retrato e um vídeo de referência em uma animação expressiva guiada por um prompt de texto obrigatório.

Perguntas Frequentes

O que esta variante do Kling Lipsync faz?

Ela gera voz a partir de texto e a sincroniza com um vídeo existente.

Quais entradas são obrigatórias?

video_url, text e voice_id são obrigatórios.

Quais requisitos se aplicam ao vídeo?

Ele deve ser .mp4 ou .mov, ter no máximo 100 MB, durar 2–10 segundos, ser 720p ou 1080p e medir 720–1920 pixels de largura e altura.

Qual é o limite do texto?

text aceita no máximo 120 caracteres.

Quais Voice ID estão disponíveis?

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1

Qual é a Voice ID padrão?

O valor padrão é genshin_vindi2.

Quais idiomas podem ser escolhidos?

voice_language oferece zh e en; o padrão é en.

Qual é o intervalo de velocidade?

voice_speed varia de 0,8 a 2; o padrão é 1.

Posso enviar meu próprio arquivo de áudio?

Não. Esta variante não contém um campo de URL de áudio.

Como devo preparar o texto?

Use frases curtas e bem pontuadas e escolha uma velocidade adequada à duração do vídeo.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.

Exemplos criados com o Kling Lipsync

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...