logo
RunComfy
  • ComfyUI
  • EntrenadorNuevo
  • Modelos
  • API
  • Precios
discord logo
MODELOS
Explorar
Todos los modelos
BIBLIOTECA
Generaciones
APIS DE MODELOS
Documentación de la API
Claves API
CUENTA
Uso

Kling Lipsync: sincronizar texto y voz con vídeo | RunComfy

kling/kling/lipsync/text-to-video

Convierte texto en voz con una Voice ID y sincronízalo con un vídeo existente.

Admite `.mp4` y `.mov`, hasta 100 MB, 2–10 segundos, 720p o 1080p y ancho y alto de 720–1920 píxeles.
Texto para generar la voz y el lipsync; máximo 120 caracteres.
Voice ID utilizada para generar la voz.
Idioma correspondiente a la Voice ID: `zh` o `en`.
Velocidad del habla de 0,8 a 2.
Idle
The rate is $0.025 per second.

Kling Lipsync con texto y voz seleccionable

Esta variante de Kling Lipsync convierte un texto en voz mediante la Voice ID elegida y lo sincroniza con un vídeo existente. El vídeo, el texto y la Voice ID son obligatorios. También se pueden ajustar el idioma y la velocidad.

Kling Lipsync en X: aportes de la comunidad

Entradas y opciones#

  • video_url, text y voice_id son obligatorios.
  • El vídeo debe ser .mp4 o .mov, ocupar como máximo 100 MB y durar de 2 a 10 segundos. Se admiten 720p o 1080p y un ancho y alto de 720–1920 píxeles.
  • text admite un máximo de 120 caracteres.
  • voice_id ofrece 27 valores fijos; el valor predeterminado es genshin_vindi2.
  • voice_language ofrece zh y en; el valor predeterminado es en.
  • voice_speed va de 0,8 a 2; el valor predeterminado es 1.

Voice ID disponibles#

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1


Flujo recomendado#

Elige una Voice ID y el idioma correspondiente, mantén el texto dentro de 120 caracteres y adapta la velocidad a la duración del vídeo. Usa frases cortas y bien puntuadas. Revisa inicios de frase, pausas, sílabas rápidas y movimientos de cabeza en el resultado.


Esta variante no contiene un campo para cargar un archivo de audio propio.

Modelos relacionados

veo-3-1/fast/image-to-video

Convierte imágenes en videos cinematográficos al instante con Veo 3.1 Fast.

elevenlabs/music-generation

Crea canciones mediante prompts, con salida WAV de 44,1 kHz y edición por secciones.

kling-2-6/motion-control-pro

Modelo de movimiento cinematográfico para creación fluida de escenas y edición visual adaptativa.

gemini-omni-flash/text-to-video

Genera vídeos cinematográficos con audio sincronizado a partir de un prompt de texto.

minimax-h3/text-to-video

MiniMax H3: texto a vídeo 768p/2K con audio estéreo nativo

kling-2-6/motion-control-standard

Herramienta de conversión de movimiento impulsada por IA que permite la creación de animaciones precisas y estables

Preguntas Frecuentes

¿Qué hace esta variante de Kling Lipsync?

Genera voz a partir de texto y la sincroniza con un vídeo existente.

¿Qué entradas son obligatorias?

video_url, text y voice_id son obligatorios.

¿Qué requisitos debe cumplir el vídeo?

Debe ser .mp4 o .mov, ocupar como máximo 100 MB, durar 2–10 segundos, ser 720p o 1080p y medir 720–1920 píxeles de ancho y alto.

¿Cuánto texto puedo introducir?

text admite un máximo de 120 caracteres.

¿Qué Voice ID están disponibles?

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1

¿Cuál es la Voice ID predeterminada?

El valor predeterminado es genshin_vindi2.

¿Qué idiomas se pueden elegir?

voice_language ofrece zh y en; el valor predeterminado es en.

¿Qué intervalo admite la velocidad?

voice_speed va de 0,8 a 2; el valor predeterminado es 1.

¿Puedo cargar mi propio archivo de audio?

No. Esta variante no contiene un campo de URL de audio.

¿Cómo conviene preparar el texto?

Usa frases cortas y bien puntuadas y elige una velocidad acorde con la duración del vídeo.

Síguenos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Soporte
  • Discord
  • Correo electrónico
  • Estado del sistema
  • afiliado
Modelos de Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos los modelos →
Modelos de Imagen
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos los modelos →
Legal
  • Términos de servicio
  • Política de privacidad
  • Política de cookies
RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.

Ejemplos creados con Kling Lipsync

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...