Générez des vidéos cinématographiques avec audio synchronisé à partir d’un prompt.
prompt peut préciser le sujet, l’action, le décor, la lumière, la caméra et, le cas échéant, l’univers sonore.duration accepte uniquement 5 ou 10 secondes ; la valeur par défaut est 5.aspect_ratio propose 16:9, 9:16 et 1:1. Le format par défaut est 16:9.negative_prompt indique ce que la génération doit éviter.generate_audio est activé par défaut. Les voix chinoises et anglaises sont prises en charge ; les autres langues sont traduites en anglais.prompt les sons ou paroles importants.9:16 en vertical, 16:9 en horizontal ou 1:1 en carré.negative_prompt pour des défauts précis, tels que le flou ou les déformations.Ce modèle texte vers vidéo ne comporte pas de champ d’image. Pour animer une image existante, passez par Kling 2.6 Pro Image-to-Video.
Générez des vidéos cinématographiques avec audio synchronisé à partir d’un prompt.
Modifiez une portion précise d’un morceau tout en préservant le reste de l’audio.
MiniMax H3 Max : texte ou image en vidéo avec audio natif à 480p/768p
Continuez une vidéo existante avec un mouvement dirigé par une invite et un son natif.
Prolongez une vidéo existante de 7 secondes en 720p, avec guidage par prompt et génération audio facultative.
Seedance 2.5 4K Image to Video : animez des images fixes en mouvement 4K
Ce modèle crée un court clip directement à partir d’une description écrite de la scène. Cette variante ne nécessite pas d’image de départ.
Seul prompt est requis. Décrivez-y le sujet, l’action, le décor et la mise en scène souhaitée.
duration accepte uniquement 5 ou 10 secondes. aspect_ratio propose 16:9, 9:16 et 1:1.
generate_audio active ou désactive la création d’un son natif et est activé par défaut. Les voix chinoises et anglaises sont prises en charge ; les autres langues sont traduites en anglais.
negative_prompt indique les éléments ou qualités à éviter, par exemple le flou ou les déformations.
Non. Le schéma d’entrée de cette variante texte vers vidéo ne comporte aucun champ d’image. Pour partir d’une image, utilisez le modèle image vers vidéo.
Décrivez précisément l’action visible, le décor, l’éclairage et la caméra. Si l’audio est activé, ajoutez les sons ou paroles importants.
Les valeurs initiales sont duration = 5, aspect_ratio = 16:9 et generate_audio = true. Le prompt négatif contient d’abord « blur, distort, and low quality ».
Oui. Vous pouvez lancer le modèle dans RunComfy ou l’intégrer à un flux avec l’API HTTP.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





