Redonnez cohérence et style cinématographique à vos vidéos IA.
Happy Horse 1.1 est le modèle vidéo nativement multimodal d’Alibaba. La gamme réunit quatre fonctions : text-to-video, image-to-video, reference-to-video et montage vidéo. Toutes reposent sur une même architecture qui génère l’image et le son en un seul passage. Dialogues, ambiance et bruitages sont ainsi synchronisés avec l’action, sans étape de sonorisation séparée.
Le modèle vise un rendu cinématographique : mouvements crédibles et physiquement cohérents, lumière et ombres nuancées, ainsi que des effets de caméra comme les travellings avant et arrière ou les bascules de mise au point. Il préserve l’identité des personnages et la continuité de la scène d’un plan à l’autre. Sa palette visuelle va de la prise de vue réaliste au lavis à l’encre, au papier découpé et à l’animation en pâte à modeler.
Cette version améliore la génération 1.0. Les actions gagnent en rythme et en impact, tandis que la ressemblance reste plus stable sur une plus grande variété de sujets, notamment les visages asiatiques.
Sur cette page RunComfy, Happy Horse 1.1 est proposé en mode text-to-video : vous décrivez la scène et recevez un court clip avec une bande-son synchronisée. Les modes image-to-video, reference-to-video et montage vidéo appartiennent à la même famille, mais sont accessibles séparément.
Format de sortie : Résolution : 720P ou 1080P / fps : 24 / durée : 3-15s / format d’image : 16:9, 9:16, 1:1 / audio : inclus
| Paramètre | Obligatoire | Type | Valeur par défaut | Plage / options | Description |
|---|---|---|---|---|---|
| prompt* | Oui (*) | string | — | — | Description de la scène, de l’action et du mouvement de caméra. |
| resolution | Non | string | 1080P | 720P, 1080P | Niveau de résolution de la sortie. |
| ratio | Non | string | 16:9 | 16:9, 9:16, 1:1 | Format d’image de la vidéo. |
| duration | Non | integer | 5 | 3-15 | Durée du clip en secondes. |
La facturation dépend de la durée et de la résolution :
| Résolution | Tarif |
|---|---|
| 720P | $0.13 par seconde |
| 1080P | $0.16 par seconde |
Exemples de coûts estimés
| Durée | 720P | 1080P |
|---|---|---|
| 5 s (par défaut) | ~$0.65 | ~$0.80 |
| 10 s | ~$1.30 | ~$1.60 |
| 15 s | ~$1.95 | ~$2.40 |
Redonnez cohérence et style cinématographique à vos vidéos IA.
Créez des vidéos dynamiques à partir d'images ou de textes.
Créez des morceaux à partir de prompts, avec sortie WAV 44.1 kHz et édition par sections.
Transformez vos images en vidéos cinématiques instantanément avec Veo 3.1 Fast, l'outil IA idéal pour les créatifs.
Retouchez une vidéo par prompt au tarif de $0.126 par seconde de sortie.
Animez vos images avec précision et fluidité pour des vidéos uniques
Happy Horse 1.1 transforme un prompt texte en un court clip aux mouvements naturels et physiquement cohérents, avec une bande-son synchronisée. Il convient aux spots courts pour les réseaux sociaux, à la prévisualisation de scènes et aux animations de produits ou de publicités créées à partir d’une seule description.
Happy Horse 1.1 corrige plusieurs limites connues de la génération 1.0 : les actions sont plus vives et mieux rythmées, et la ressemblance reste plus stable sur des sujets variés. D’après les informations publiques disponibles, le rendu des visages asiatiques a également été amélioré. La version 1.1 est donc plus fiable pour les clips centrés sur des personnages.
Oui. Happy Horse 1.1 crée une bande-son synchronisée avec l’image, ce qui permet d’obtenir directement un clip sonorisé. Indiquez dans le prompt les dialogues, l’ambiance ou les effets souhaités pour orienter le résultat audio.
Happy Horse 1.1 produit des vidéos à 24 fps en 720P ou 1080P, d’une durée de 3 à 15 secondes. Les formats 16:9, 9:16 et 1:1 sont disponibles pour les usages paysage, portrait ou carré.
Commencez par le sujet principal et une action claire. Ajoutez ensuite le décor, l’éclairage et le mouvement de caméra. Comme Happy Horse 1.1 crée l’image et le son ensemble, décrivez aussi précisément le mouvement et les éléments sonores attendus pour obtenir un résultat plus prévisible.
Vous fournissez un prompt texte et choisissez la résolution, le format d’image et la durée, comprise entre 3 et 15 secondes. Consultez les réglages affichés sur la page RunComfy du modèle pour connaître les limites exactes, car certaines options peuvent varier selon le fournisseur.
Oui. Vous pouvez d’abord tester le prompt et les réglages dans l’interface RunComfy, puis appeler le même modèle avec des paramètres identiques via l’API RunComfy. Il n’est pas nécessaire d’héberger ni de dimensionner vous-même l’infrastructure du modèle.
La facturation s’effectue à la seconde : $0.13 par seconde en 720P et $0.16 par seconde en 1080P. Un clip de 5 secondes en 1080P coûte donc environ $0.80. Consultez la section « Génération » de la page du modèle pour connaître les tarifs actuels.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





