Wan 3.0 Reference To Video erstellt Clips aus Bild-, Video- und Audioreferenzen
LTX 2.5 ist das offene Audio-Video-Modell von Lightricks zur Erzeugung synchronisierter Bilder und Töne aus Text, Bildern oder Audio. Auf dieser Seite wird das Tool Image-to-Video Fast ausgeführt: Animieren Sie ein Standbild in einen Clip mit optionalem nativem Audio in einem geschwindigkeitsorientierten Modus, der für schnelle Entwürfe entwickelt wurde. Die gleichgeordneten RunComfy-Seiten decken die Text-zu-Video- und Audio-zu-Video-Fast-Modi in derselben LTX 2.5-Familie ab.
Entwickler entscheiden sich für LTX 2.5, wenn sie offene Gewichte und gehostete Fast-Tools benötigen. Über Aufgaben hinweg sorgt LTX 2.5 dafür, dass Identität und Klang während der Iteration besser aufeinander abgestimmt sind. Viele Teams beginnen auf dieser „Image-to-Video Fast“-Seite und wechseln dann zu anderen LTX 2.5-Aufgabenseiten, ohne die kreative Richtung zu ändern.
| LTX 2.5 Vorteil | Was es für Sie bedeutet |
|---|---|
| Native Multi-Shot-Kontinuität | Direkt verbundene Szenen in einem Durchgang, sodass Charakter-Look, Bühnenbild, Beleuchtung, Stimme und Gradierung über alle Schnitte hinweg aufeinander abgestimmt bleiben. |
| Adaptive Details, wo es darauf ankommt | Das Rendering-Budget ändert sich mit der Komplexität der Szene, sodass Gesichter, Texturen und Schrift auf dem Bildschirm bei Bedarf schärfer bleiben. |
| Aktualisierter Videodecoder | Sauberere Bewegungen, weniger Rekonstruktionsartefakte und stabilere Details im Vergleich zu früheren LTX-Generationen. |
| Stärkerer Halt | Ein Gemma 4 12B-Text-Encoder plus Prompt-Enhancer hilft LTX 2.5 dabei, Anweisungen für mehrere Zeichen, Kamera und Beleuchtung beizubehalten. |
| Schnelle Iterationsstufe | Wählen Sie die Dauer „auto“ oder feste Längen und skalieren Sie von 720p bis 4K („2160p“), wobei Audio im Preis inbegriffen ist. |
LTX 2.5 deckt Standanimationen, Textentwürfe und Audio-getaktete Clips auf den Geschwister-Fast-Seiten ab; Dieses Tool konzentriert sich auf Bild-zu-Video.
auto oder 6–20 s), Auflösung (720p–2160p), Seitenverhältnis (auto, 16:9, 9:16), FPS, Audio ein/aus und optionale Kamerabewegung.Steuerelemente auf dieser Seite LTX 2.5 Image-to-Video Fast:
| Parameter | Erforderlich | Geben Sie | ein Standard | Sortiment / Optionen | So wählen Sie |
|---|---|---|---|---|---|
image_url* | Ja (*) | Bild-URL | Beispiel noch | JPG, JPEG, PNG, WEBP, GIF, AVIF | Verwenden Sie ein scharfes, gut beleuchtetes Standbild. Die Komposition sperrt weitgehend den Rahmen, den LTX 2.5 animieren wird. |
end_image_url | Nein | Bild-URL | — | Gleiche Formate | Nur für einen Start→End-Morph hinzufügen; Für eine Bewegung mit offenem Ende ab dem ersten Bild leer lassen. |
prompt* | Ja (*) | Zeichenfolge | Beispielaufforderung | Bis zu 5.000 Zeichen | Behandeln Sie Handlung, Kamera, Beleuchtung, Stil und Audioquellen in einem zusammenhängenden Brief. |
| „Dauer“ | Nein | Zeichenfolge | auto | auto, 6, 8, 10, 12, 14, 16, 18, 20 | Verwenden Sie „auto“, um LTX 2.5 auf die Länge schließen zu lassen; Wählen Sie feste Sekunden aus, wenn das Timing mit einer Bearbeitung übereinstimmen muss. |
| „Auflösung“ | Nein | Zeichenfolge | 1080p | 720p, 1080p, 1440p, 2160p | Entwurf bei 720p; Steigen Sie auf, um Heldenplatzierungen und große Ernten zu erhalten. |
aspect_ratio | Nein | Zeichenfolge | auto | auto, 16:9, 9:16 | Bevorzugen Sie „auto“, um dem Standbild zu folgen; erzwingen Sie „16:9“ oder „9:16“ für die Plattformbereitstellung. |
fps | Nein | Ganzzahl | 25 | „24“, „25“, „48“, „50“ | Passende redaktionelle Kadenz („24“/„25“) oder sanftere Bewegungen („48“/„50“). |
generate_audio | Nein | Boolescher Wert | „wahr“ | „wahr“ / „falsch“ | Machen Sie weiter für synchronisierte Atmosphäre, SFX oder Dialoge; Ausschalten für stille Bildplatten. |
camera_motion | Nein | Zeichenfolge | — | dolly_in, dolly_out, dolly_left, dolly_right, jib_up, jib_down, static, focus_shift | Optionale Makrobewegung, wenn Sie einen vorgeschriebenen Kamerapfad über der Eingabeaufforderung wünschen. |
Die Abrechnung für LTX 2.5 auf dieser Seite erfolgt pro Sekunde des generierten Videos. LTX 2.5 Image-to-Video Fast beinhaltet natives Audio in jeder Auflösung.
| Auflösung | Preis pro Sekunde | 6s | 10s | 20er Jahre |
|---|---|---|---|---|
| 720p | 0,10 $ | 0,60 $ | 1,00 $ | 2,00 $ |
| 1080p | 0,14 $ | 0,84 $ | 1,40 $ | 2,80 $ |
| 1440p | 0,21 $ | 1,26 $ | 2,10 $ | 4,20 $ |
| 4K (2160p) | 0,33 $ | 1,98 $ | 3,30 $ | 6,60 $ |
Für Batches gilt insgesamt ≈ „Dauer × Sekundenrate × Ausgabeanzahl“. Wenn die Dauer „auto“ beträgt, folgt die Abrechnung von LTX 2.5 der tatsächlich generierten Länge.
Wiederverwendbare Struktur für LTX 2.5 (eine Hauptaktion pro Clip beibehalten):
„[wer/was ist auf dem Bildschirm] + [Aktion im Laufe der Zeit] + [Kamera] + [Beleuchtung und Umgebung] + [Aussehen/Gradierung] + [Audioquellen] + [Endtakt]“.
Schwache Eingabeaufforderung
> Machen Sie das Foto mit schönen Kamerabewegungen und Ton filmisch.
Verbesserte Eingabeaufforderung für LTX 2.5
> Eine Frau in einem anthrazitfarbenen Wollmantel steht nachts unter einem durchsichtigen Regenschirm an einem regennassen Zebrastreifen in Tokio. Sie lässt den Regenschirm sinken, betritt den Zebrastreifen, während ein gelbes Taxi mitten durch den Boden gleitet und neonfarbene Kanji-Schilder über den nassen Asphalt kräuseln. Weitwinkelaufnahme, feine Regenstreifen, sanfte Reflexionen. Audio: leichter Regen, fernes Verkehrsbrummen, ein leises Reifenzischen auf dem Wasser.
Verwenden Sie diesen LTX 2.5-Familienleitfaden. Die genauen Grenzwerte hängen vom Endpunkt ab. Basierend auf öffentlich zugänglichen Informationen.
| Modell | Herausragend | Typische Passform |
|---|---|---|
| LTX 2.5 | Offenes AV-Modell mit Multi-Shot-Kontinuität, schnellen Modi und Auflösungen bis 4K | Synchronisiertes Audio-Video aus Standbildern, Text oder Audio mit verfügbaren offenen Gewichten |
| LTX 2 | Frühere Lightricks AV-Generation mit Fast/Pro-Stufen | Pipelines, die noch keine 2,5-Kontinuitätsverbesserungen benötigen |
| Kling 3.0 | Multi-Shot-Eingabeaufforderung mit starken Lippensynchronisationsoptionen | Geskriptete Charakteranzeigen und dialoggeführte Spots |
| Seedance 2,0 / 2,5 | Dichte Referenzmischung für Bild, Video und Audio | Markenarbeit, die Identität aus vielen Referenzen sperren muss |
| MiniMax H3 | Multimodale Familie mit Stereo-Audio und Referenz-Workflows | Prompt-First-Entwürfe, die später möglicherweise Referenzen im Omni-Stil hinzufügen |
Wählen Sie LTX 2.5, wenn sowohl offene Gewichtungen als auch schnelle Cloud-Endpunkte wichtig sind. Was LTX 2.5 auszeichnet, ist die Multi-Shot-Kontinuität mit nativem Audio in einem Durchgang. Führen Sie das gleiche Briefing für alle Modelle durch, bevor Sie einen Produktionspfad sperren.
Veröffentlichte LTX 2.5-Gewichte unterstützen auch die lokale Feinabstimmung, wenn gehostete Entwürfe nicht ausreichen.
Wan 3.0 Reference To Video erstellt Clips aus Bild-, Video- und Audioreferenzen
Bearbeite einen präzise gewählten Abschnitt einer Audiospur, ohne den Rest zu verändern.
Erstellen Sie aus einem erforderlichen Prompt ein 5- oder 10-sekündiges Video. Wählen Sie `16:9`, `9:16` oder `1:1`, fügen Sie optional eine negative Prompt hinzu und passen Sie die Stärke der Prompt an.
Verwandeln Sie Standporträts mit Kontrolle und Präzision in ausdrucksstarke, lebensechte Videos.
Entfernen Sie Videohintergründe mit der Fast-Variante und steuern Sie Codec, Kantenverfeinerung und Motivtyp.
Erzeugen Sie filmische Videos mit synchronisiertem Ton aus einem Text-Prompt.
LTX 2.5 animiert ein Standbild in ein kurzes Video mit optionalem synchronisiertem Audio. Auf dieser Seite verwenden Sie das Image-to-Video Fast-Tool für schnelle Entwürfe, während auf den Geschwisterseiten die Text-to-Video- und Audio-to-Video-Fast-Modi derselben Modellfamilie behandelt werden.
LTX 2.5 kann zusammenhängende Szenen in einem Durchgang erzeugen, sodass das Erscheinungsbild, die Umgebung, die Beleuchtung, die Stimme und der visuelle Stil der Charaktere über alle Schnitte hinweg konsistenter bleiben. Das hilft bei Kampagnenanimationen und Multi-Beat-Spots, die bisher separate Single-Shot-Generationen erforderten.
Sie können bei 720p, 1080p, 1440p oder 4K (2160p) generieren, wobei die Dauer auf auto oder feste Längen von 6–20 Sekunden eingestellt ist. Zu den FPS-Optionen gehören 24, 25, 48 und 50, und das Seitenverhältnis kann dem Standbild (auto) folgen oder 16:9 oder 9:16 verwenden.
Ja. Geben Sie ein Startbild (erforderlich) und optional ein Endbild an, wenn Sie einen geführten Übergang zwischen zwei Kompositionen wünschen. Lassen Sie das Endbild leer, um eine Bewegung mit offenem Ende nur ab dem ersten Bild zu ermöglichen.
Wenn generate_audio aktiviert ist, kann natives Audio mit dem Bild generiert werden, und Audio ist bei jeder Auflösung in der Rate pro Sekunde enthalten. Schalten Sie den Ton aus, wenn Sie für die spätere Soundgestaltung eine Silentplatte benötigen.
Eingabeaufforderungen können bis zu 5.000 Zeichen lang sein. Start- und optionale Endbilder akzeptieren gängige Formate wie JPG, PNG, WEBP, GIF und AVIF. Überprüfen Sie das aktuelle RunComfy-Parameterfeld auf zusätzliche Upload-Größenbeschränkungen.
Ja. Erstellen Sie einen Prototyp in der RunComfy-Web-Benutzeroberfläche und rufen Sie dann dasselbe LTX 2.5 Image-to-Video-Fast-Modell über HTTP API mit passenden Parametern für automations- und Produktionsworkflows auf.
Die Abrechnung erfolgt pro Sekunde des generierten Videos: 0,10 $ bei 720p, 0,14 $ bei 1080p, 0,21 $ bei 1440p und 0,33 $ bei 4K (2160p). Bei einer Dauer von auto folgt die Gebühr der tatsächlich generierten Länge. Generationen verbrauchen USD/Credits am RunComfy; Neue Benutzer erhalten in der Regel einen kostenlosen Testbetrag.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





