logo
RunComfy
  • ComfyUI
  • EntraîneurNouveau
  • Modèles
  • API
  • Tarification
discord logo
MODÈLES
Explorer
Tous les modèles
BIBLIOTHÈQUE
Générations
APIS DE MODÈLES
Documentation API
Clés API
COMPTE
Utilisation

Kling Lipsync : synchroniser texte et voix avec une vidéo | RunComfy

kling/kling/lipsync/text-to-video

Transformez un texte en voix avec une Voice ID et synchronisez-le avec une vidéo existante.

Accepte `.mp4` et `.mov`, au plus 100 Mo, 2–10 secondes, 720p ou 1080p, avec largeur et hauteur de 720–1920 pixels.
Texte utilisé pour générer la voix et le lipsync ; 120 caractères maximum.
Voice ID utilisée pour la synthèse vocale.
Langue correspondant à la Voice ID : `zh` ou `en`.
Vitesse d’élocution de 0,8 à 2.
Idle
The rate is $0.025 per second.

Kling Lipsync avec texte et voix au choix

Cette variante de Kling Lipsync transforme un texte en voix avec la Voice ID sélectionnée, puis la synchronise avec une vidéo existante. La vidéo, le texte et la Voice ID sont obligatoires. La langue et la vitesse peuvent aussi être réglées.

Kling Lipsync sur X : créations de la communauté

Entrées et options#

  • video_url, text et voice_id sont obligatoires.
  • La vidéo doit être au format .mp4 ou .mov, peser au plus 100 Mo et durer de 2 à 10 secondes. Les résolutions 720p ou 1080p et des dimensions de 720–1920 pixels sont acceptées.
  • text est limité à 120 caractères.
  • voice_id propose 27 valeurs fixes ; la valeur par défaut est genshin_vindi2.
  • voice_language propose zh et en ; la valeur par défaut est en.
  • voice_speed va de 0,8 à 2 ; la valeur par défaut est 1.

Voice ID disponibles#

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1


Méthode conseillée#

Choisissez une Voice ID et la langue correspondante, limitez le texte à 120 caractères et adaptez la vitesse à la durée de la vidéo. Utilisez des phrases courtes et bien ponctuées. Vérifiez les débuts de phrase, les pauses, les syllabes rapides et les mouvements de tête.


Cette variante ne comporte aucun champ permettant de charger son propre fichier audio.

Modèles associés

wan-2-2/lora/image-to-video

Animez une image de départ depuis un prompt et réglez LoRA, images, FPS, résolution, rapport, étapes et seed.

wan-2-2/lora/text-to-image

Créez une image depuis un prompt et réglez LoRA, format, fichier, étapes, prompt négatif et seed.

kling-3.0/standard/text-to-video

Créez des films multi-scènes avec des dialogues synchronisés et des personnages cohérents. Use Kling 3.0 on RunComfy.

kling-2-6/pro/text-to-video

Transformez un prompt en courte vidéo, avec durée, format et génération audio au choix.

one-to-all-animation/14b

Animez une image de personnage de référence avec le mouvement d’une vidéo pilote à l’aide des commandes d’invite, de résolution, d’inférence, de guidage d’image et de guidage de pose.

pixverse/v5.5/image-to-video

Animez une image de départ par le texte et réglez format, résolution, durée, style, audio et mode multi-clips.

Questions Fréquemment Posées

Que fait cette variante de Kling Lipsync ?

Elle génère une voix à partir d’un texte et la synchronise avec une vidéo existante.

Quelles entrées sont obligatoires ?

video_url, text et voice_id sont obligatoires.

Quelles contraintes s’appliquent à la vidéo ?

Elle doit être en .mp4 ou .mov, peser au plus 100 Mo, durer 2–10 secondes, être en 720p ou 1080p et mesurer 720–1920 pixels en largeur et en hauteur.

Quelle longueur de texte est acceptée ?

text est limité à 120 caractères.

Quelles Voice ID sont disponibles ?

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1

Quelle est la Voice ID par défaut ?

La valeur par défaut est genshin_vindi2.

Quelles langues sont proposées ?

voice_language propose zh et en ; la valeur par défaut est en.

Quelle plage est disponible pour la vitesse ?

voice_speed va de 0,8 à 2 ; la valeur par défaut est 1.

Puis-je charger mon propre fichier audio ?

Non. Cette variante ne contient aucun champ d’URL audio.

Comment préparer le texte ?

Utilisez des phrases courtes et bien ponctuées et choisissez une vitesse adaptée à la durée de la vidéo.

Suivez-nous
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • Email
  • État du système
  • affilié
Modèles vidéo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Voir tous les modèles →
Modèles d'images
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Voir tous les modèles →
Légal
  • Conditions d'utilisation
  • Politique de confidentialité
  • Politique relative aux cookies
RunComfy
Droits d'auteur 2026 RunComfy. Tous droits réservés.

RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.

Exemples réalisés avec Kling Lipsync

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...