Transformez vos visuels statiques en contenu vidéo synchronisé avec le mouvement et haute définition grâce à Wan 2.6 et son contrôle flexible.
LTX-2 19B Text-to-Video LoRA est un transformateur de diffusion adaptable LoRA au paramètre 19B pour générer de courtes vidéos avec audio synchronisé directement à partir du texte. Il accepte les invites et les adaptateurs LoRA en option et produit des clips vidéo cohérents et stylisés avec de l'audio dans plusieurs résolutions, durées et formats d'image adaptés au contenu de marque, aux médias sociaux, à l'animation et au prototypage rapide.
Format de sortie : 480p–1080p / durée 5–20 s / format d'image 16:9 ou 9:16 / audio inclus
seed fixe pour verrouiller les résultats et affiner les invites avec des mises à jour prévisibles.| Paramètre | Obligatoire | Type | Valeur par défaut | Plage/options | Description |
|---|---|---|---|---|---|
prompt* | Oui (*) | string | — | — | Description de la scène, de l’action et des indications audio |
resolution | Non | enum | 720p | 480p, 720p, 1080p | Résolution de sortie |
aspect_ratio | Non | enum | 16:9 | 16:9, 9:16 | Format de sortie |
duration | Non | number | 5 | 5–20 secondes | Durée de la vidéo |
loras | Non | list | — | jusqu’à 3 | Adaptateurs LoRA à appliquer |
seed | Non | integer | -1 | -1 pour une valeur aléatoire | Graine pour des résultats reproductibles |
L'utilisation de LTX-2 19B Text-to-Video LoRA est facturée à la seconde générée par résolution.
| Résolution | Prix par seconde | Unité de facturation |
|---|---|---|
| 480p | 0,017 $ | Par seconde générée |
| 720p | 0,022 $ | Par seconde générée |
| 1080p | 0,033 $ | Par seconde générée |
1) Sélectionnez le modèle sur RunComfy : Choisissez LTX-2 19B Text-to-Video LoRA dans le catalogue Modèles.
2) Rédigez le prompt : décrivez le sujet, les actions, le décor, le mouvement de la caméra, l'éclairage et les principaux signaux audio (ambiance, effets ou dialogue).
3) Ajouter des adaptateurs (facultatif) : dans le champ loras, référencez jusqu'à trois adaptateurs LoRA pour piloter le style ou l'identité ; LTX-2 19B Text-to-Video LoRA les mélangera lors de la génération.
4) Définissez les contrôles de sortie : choisissez la résolution (480p/720p/1080p), le rapport hauteur/largeur (16:9 ou 9:16) et la durée (5 à 20 s) pour correspondre au canal cible.
5) Reproductibilité : attribuez à seed un nombre entier fixe pour recréer un résultat, ou sur -1 pour une exploration avec de nouvelles variations.
6) Générer : soumettez le travail et prévisualisez le clip avec l'audio synchronisé ; LTX-2 19B Text-to-Video LoRA génère un seul fichier vidéo.
7) Révisez et itérez : ajustez le prompt ou la liste de LoRA, modifiez la durée/le rapport si le cadrage ne convient pas et réexécutez avec le même seed pour des modifications contrôlées.
8) Compatible API : utilisez les points de terminaison API de RunComfy pour automatiser les tâches par lots sans gérer l'infrastructure ou le provisionnement du GPU.
seed itératifs : conservez un seed fixe et modifiez le prompt par petites étapes ; cela stabilise les comparaisons et rend les changements plus faciles à juger avec LTX-2 19B Text-to-Video LoRA.Si LTX-2 19B Text-to-Video LoRA ne convient pas, considérez :
Transformez vos visuels statiques en contenu vidéo synchronisé avec le mouvement et haute définition grâce à Wan 2.6 et son contrôle flexible.
MiniMax H3 Max text to video : clips 480p/768p avec audio natif
Générez une vidéo à partir d’images de référence et d’éléments obligatoires. Utilisez les jetons @Image et @Element dans l’ordre des listes, puis réglez précisément la durée et le format d’image.
Retouchez une vidéo par prompt au tarif de $0.126 par seconde de sortie.
Créez une vidéo à partir d'un prompt textuel avec un rapport hauteur/largeur sélectionnable et une durée de 5 ou 10 secondes.
Associez une piste audio à une vidéo existante, avec prompt et seed facultatifs.
LTX-2 19B Text-to-Video LoRA prend en charge, au niveau du modèle, jusqu’à la 4K native (3840×2160) à 50 fps. Ce flux propose les préréglages 480p, 720p et 1080p, ainsi que les formats 16:9 et 9:16. Un prompt peut actuellement contenir environ 512 tokens.
Vous pouvez charger jusqu’à trois modules LoRA à la fois. Il peut s’agir d’IC-LoRA pour contrôler la pose, la profondeur ou les contours et améliorer la cohérence structurelle de la composition.
Commencez par régler les prompts et les paramètres dans le navigateur. Utilisez ensuite l’API RunComfy pour automatiser la génération, le chargement des adaptateurs et le post-traitement. Le même système de crédits en USD que sur la page du modèle s’applique.
Le modèle convient particulièrement aux clips marketing, vidéos pédagogiques, dialogues de personnages animés et contenus courts stylisés nécessitant une fréquence d’image élevée et un son synchronisé. Les LoRA configurables facilitent aussi la cohérence de marque.
Son architecture Diffusion Transformer (DiT) modélise conjointement les images vidéo et l’onde audio. Le rythme des dialogues, la synchronisation labiale et les sons ambiants sont ainsi générés en un seul passage, sans synthèse audio séparée.
Oui. Des flux d’entraînement LoRA légers permettent d’adapter le style, le mouvement ou les personnages, puis d’intégrer ces adaptateurs au pipeline principal. Vous pouvez entraîner vos LoRA avec RunComfy Trainer.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





