Animez une image de départ obligatoire à partir d’un prompt textuel, en guidant éventuellement la fin avec une image de fin.
Happy Horse 1.1 reference to video est le mode guidé par références du modèle vidéo nativement multimodal d’Alibaba. Vous fournissez une ou plusieurs images de référence et une description textuelle. Le modèle crée alors un court clip qui reprend le sujet, le style ou la composition des images tout en ajoutant mouvement et son synchronisé en un seul passage.
Ce mode repose sur la même architecture que le reste de la famille Happy Horse 1.1. Il produit donc des mouvements crédibles et physiquement cohérents, une lumière et des ombres nuancées, ainsi que des effets de caméra comme les travellings avant et arrière ou les bascules de mise au point. L’identité des personnages reste stable sur l’ensemble du clip, du rendu photoréaliste à l’animation stylisée.
Cette version améliore la génération 1.0 : les actions gagnent en rythme et en impact, tandis que la ressemblance reste plus stable sur une plus grande variété de sujets, notamment les visages asiatiques, avec moins d’artefacts de morphing.
Format de sortie : Résolution : 720P ou 1080P / fps : 24 / durée : 3-15s / format d’image : 16:9, 9:16, 1:1 / audio : inclus
Animez une image de départ obligatoire à partir d’un prompt textuel, en guidant éventuellement la fin avec une image de fin.
Générez une vidéo de 5 ou 10 secondes à partir d'une invite requise. Ajoutez éventuellement une piste audio WAV ou MP3, une invite négative et l'une des 13 tailles de sortie.
Créez des clips 1080p avec plusieurs références et un contrôle précis des images.
Générez une vidéo 768p ou 2K à partir de références d'image, de vidéo et d'audio
Transforme des images fixes en clips dynamiques et expressifs avec un son synchronisé.
Générez une vidéo 16:9 à partir d’une image et d’un prompt, avec durée, résolution, fréquence d’images et audio au choix.
Happy Horse 1.1 reference to video crée un court clip à partir de vos images de référence. Le sujet, le style ou la composition des sources se retrouvent ainsi dans le résultat. Le mode convient aux scènes où un personnage doit rester cohérent, aux présentations de produits et aux vidéos de marque qui doivent respecter une esthétique précise.
Le mode text-to-video part uniquement d’un prompt. Happy Horse 1.1 reference to video utilise au contraire jusqu’à 9 images de référence pour ancrer le résultat avant d’ajouter le mouvement. Il est donc préférable lorsque l’identité, l’apparence d’un produit ou un style visuel précis doivent rester cohérents dans toute la vidéo.
Par rapport à la version précédente, Happy Horse 1.1 reference to video offre des mouvements plus dynamiques, moins d’artefacts de morphing et une ressemblance plus stable sur une plus grande variété de sujets, notamment les visages asiatiques. D’après les informations publiques disponibles, les actions auparavant trop lentes gagnent en rythme et en impact.
Oui. Les dialogues, l’ambiance et les bruitages sont créés avec l’image en un seul passage et synchronisés avec l’action. Aucune étape distincte de conception sonore n’est donc nécessaire.
Vous pouvez fournir jusqu’à 9 images de référence ; la première sert de repère principal. N’ajoutez d’autres images que si chacune apporte une information distincte, par exemple un second sujet ou une référence de style. Les formats acceptés et les limites en vigueur sont indiqués dans les réglages de la page RunComfy du modèle.
Happy Horse 1.1 reference to video produit des clips de 3 à 15 secondes en 720P ou 1080P. Les formats 16:9, 9:16 et 1:1 sont disponibles. Utilisez 720P pour des essais moins coûteux et 1080P pour la version finale ; certaines limites peuvent varier selon le mode ou le fournisseur.
Oui. Vous pouvez d’abord tester les références, le prompt et les réglages dans le RunComfy AI Playground, puis appeler le modèle avec les mêmes paramètres via l’API RunComfy pour l’automatisation ou la production. La configuration validée dans le navigateur reste ainsi identique lors de l’intégration.
La facturation dépend de la durée et de la résolution : $0.13 par seconde en 720P et $0.16 par seconde en 1080P. Un clip de 5 secondes coûte donc environ $0.65 en 720P ou $0.80 en 1080P. Les coûts sont déduits de votre solde RunComfy ; les nouveaux utilisateurs disposent généralement d’un crédit d’essai gratuit.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





