Erzeugen Sie Videos zwischen Start- und Endbildern mit optionalem Audio
LTX-2 19B Text-to-Video LoRA ist ein LoRA-fähiger Diffusion Transformer mit 19 Milliarden Parametern, der aus Text kurze Videos mit synchronisiertem Ton erzeugt. Das Modell verarbeitet Prompts und optionale LoRA-Adapter und erstellt stilistisch konsistente Clips in verschiedenen Auflösungen, Laufzeiten und Seitenverhältnissen – für Markeninhalte, Social Media, Animation und schnelles Prototyping.
Ausgabeformat: 480p–1080p / Dauer 5–20s / Seitenverhältnis 16:9 oder 9:16 / Audio inklusive
seed, um die Ausgangsbasis beizubehalten und Prompts kontrolliert zu verfeinern.| Parameter | Erforderlich | Typ | Standard | Bereich/Optionen | Beschreibung |
|---|---|---|---|---|---|
prompt* | Ja (*) | string | — | — | Textbeschreibung von Szene, Handlung und Audiohinweisen |
resolution | Nein | enum | 720p | 480p, 720p, 1080p | Ausgabeauflösung |
aspect_ratio | Nein | enum | 16:9 | 16:9, 9:16 | Ausgabeformat |
duration | Nein | number | 5 | 5–20 Sekunden | Videolänge |
loras | Nein | list | — | bis zu 3 | Anzuwendende LoRA-Adapter |
seed | Nein | integer | -1 | -1 für Zufall | Seed für reproduzierbare Ergebnisse |
Die Nutzung von LTX-2 19B Text-to-Video LoRA wird pro erzeugter Sekunde je nach Auflösung abgerechnet.
| Auflösung | Preis pro Sekunde | Abrechnungseinheit |
|---|---|---|
| 480p | 0,017 $ | Pro erzeugter Sekunde |
| 720p | 0,022 $ | Pro erzeugter Sekunde |
| 1080p | 0,033 $ | Pro erzeugter Sekunde |
1) Wählen Sie das Modell auf RunComfy: Wählen Sie LTX-2 19B Text-to-Video LoRA aus dem Modellkatalog.
2) Formulieren Sie den Prompt: Beschreiben Sie das Thema, die Aktionen, die Einstellung, die Kamerabewegung, die Beleuchtung und die wichtigsten Audiohinweise (Atmosphäre, Effekte oder Dialog).
3) Adapter hinzufügen (optional): Verweisen Sie im Feld loras auf bis zu drei LoRA-Adapter, um Stil oder Identität zu steuern; LTX-2 19B Text-to-Video LoRA vermischt sie während der Generierung.
4) Legen Sie die Ausgabesteuerung fest: Wählen Sie Auflösung (480p/720p/1080p), Seitenverhältnis (16:9 oder 9:16) und Dauer (5–20 s) passend zum Zielkanal.
5) Reproduzierbarkeit: Setzen Sie seed auf eine feste Ganzzahl, um ein Ergebnis wiederherzustellen, oder -1 für die Erkundung neuer Variationen.
6) Generieren: Senden Sie den Auftrag und zeigen Sie eine Vorschau des Clips mit synchronisiertem Audio an. LTX-2 19B Text-to-Video LoRA gibt eine einzelne Videodatei aus.
7) Überprüfen und iterieren: Passen Sie die Eingabeaufforderung oder die LoRA-Liste an, optimieren Sie die Dauer/das Verhältnis, wenn die Bildkomposition nicht passt, und führen Sie es mit demselben seed erneut aus, um kontrollierte Änderungen zu erzielen.
8) API-freundlich: Verwenden Sie die API-Endpunkte von RunComfy, um Batch-Jobs zu automatisieren, ohne die Infrastruktur oder GPU-Bereitstellung zu verwalten.
seed: Fixieren Sie seed, um die Eingabeaufforderung in kleinen Schritten zu optimieren; Dies stabilisiert Vergleiche und erleichtert die Beurteilung von Änderungen mit LTX-2 19B Text-to-Video LoRA.Wenn LTX-2 19B Text-to-Video LoRA nicht passt, überlegen Sie Folgendes:
Erzeugen Sie Videos zwischen Start- und Endbildern mit optionalem Audio
Erstelle in Sekunden realistische Bewegtbilder mit Dreamina 3.0.
Animieren Sie mit Hailuo 02 Pro ein Ausgangsbild anhand eines Prompts zu einem sechssekündigen Video.
Synchronisieren Sie eine Audiospur mit einem Video und legen Sie fest, ob das Video wiederholt wird.
FLUX 3 Draft Keyframes: Schnelle Multi-Keyframe-Videovorschau mit 720p
Erstelle fließende, ausdrucksstarke Animationen mit Storytelling-Fokus.
LTX-2 19B Text-to-Video LoRA unterstützt modellseitig bis zu natives 4K (3840×2160) bei 50 fps. In diesem Workflow stehen 480p, 720p und 1080p sowie 16:9 und 9:16 zur Auswahl. Ein Prompt kann derzeit ungefähr 512 Tokens umfassen.
Es können bis zu drei LoRA-Module gleichzeitig geladen werden. Dazu zählen optionale IC-LoRAs für Steuersignale wie Pose, Tiefe oder Kanten, die die strukturelle Konsistenz der Text-zu-Video-Komposition verbessern.
Optimieren Sie Prompts und Einstellungen zunächst im Browser. Für den Produktionseinsatz können Sie anschließend die RunComfy API nutzen, um Videogenerierung, Adapterladen und Nachbearbeitung zu automatisieren. Dabei gilt dasselbe USD-basierte Creditsystem wie auf der Modellseite.
Das Modell eignet sich für Marketingclips, Lernvideos, animierte Figurendialoge und stilisierte Kurzvideos, bei denen eine hohe Bildrate und synchronisierter Ton wichtig sind. Konfigurierbare LoRAs helfen außerdem, Markenstile konsistent zu halten.
Ein Diffusion-Transformer-Backbone (DiT) modelliert Videoframes und die zugehörige Audiowellenform gemeinsam. Dadurch entstehen Dialogtiming, Lippensynchronisation und Umgebungsgeräusche in einem Durchlauf, ohne separate Audiosynthese.
Ja. Leichtgewichtige LoRA-Trainingsabläufe ermöglichen die gezielte Anpassung von Stil, Bewegung oder Figuren. Die Adapter werden in die Hauptpipeline eingebunden, ohne deren Text-zu-Video-Konsistenz aufzugeben. Eigene LoRAs können Sie mit dem RunComfy Trainer trainieren.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





