Créez une vidéo à partir d’une image, d’un fichier audio et d’un prompt, avec un contrôle distinct du texte et de l’audio.
prompt peut préciser le sujet, l’action, le décor, la lumière, la caméra et, le cas échéant, l’univers sonore.duration accepte uniquement 5 ou 10 secondes ; la valeur par défaut est 5.aspect_ratio propose 16:9, 9:16 et 1:1. Le format par défaut est 16:9.negative_prompt indique ce que la génération doit éviter.generate_audio est activé par défaut. Les voix chinoises et anglaises sont prises en charge ; les autres langues sont traduites en anglais.prompt les sons ou paroles importants.9:16 en vertical, 16:9 en horizontal ou 1:1 en carré.negative_prompt pour des défauts précis, tels que le flou ou les déformations.Ce modèle texte vers vidéo ne comporte pas de champ d’image. Pour animer une image existante, passez par Kling 2.6 Pro Image-to-Video.
Créez une vidéo à partir d’une image, d’un fichier audio et d’un prompt, avec un contrôle distinct du texte et de l’audio.
Créez une image depuis un prompt et réglez LoRA, format, fichier, étapes, prompt négatif et seed.
Créez un nouveau plan à partir d’une vidéo de référence et guidez-le avec un prompt, des éléments, des images, le format, la durée et la bande-son d’origine.
Créez une courte vidéo avec son synchronisé à partir d’images de référence et d’une invite.
Transformation de séquences par IA avec mouvements stables et contrôle créatif.
Générez une vidéo 16:9 à partir d’une image et d’un prompt, avec durée, résolution, fréquence d’images et audio au choix.
Ce modèle crée un court clip directement à partir d’une description écrite de la scène. Cette variante ne nécessite pas d’image de départ.
Seul prompt est requis. Décrivez-y le sujet, l’action, le décor et la mise en scène souhaitée.
duration accepte uniquement 5 ou 10 secondes. aspect_ratio propose 16:9, 9:16 et 1:1.
generate_audio active ou désactive la création d’un son natif et est activé par défaut. Les voix chinoises et anglaises sont prises en charge ; les autres langues sont traduites en anglais.
negative_prompt indique les éléments ou qualités à éviter, par exemple le flou ou les déformations.
Non. Le schéma d’entrée de cette variante texte vers vidéo ne comporte aucun champ d’image. Pour partir d’une image, utilisez le modèle image vers vidéo.
Décrivez précisément l’action visible, le décor, l’éclairage et la caméra. Si l’audio est activé, ajoutez les sons ou paroles importants.
Les valeurs initiales sont duration = 5, aspect_ratio = 16:9 et generate_audio = true. Le prompt négatif contient d’abord « blur, distort, and low quality ».
Oui. Vous pouvez lancer le modèle dans RunComfy ou l’intégrer à un flux avec l’API HTTP.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





