33 Gesichtsausdrücke, 400+ Bewegungen, filmisch inszenierte KI-Clips
Wan 3.0 Text To Video liest eine Beschreibung in einfacher Sprache und gibt einen kurzen Filmclip zurück. Sie beschreiben das Motiv, die Aktion, die Kamera und das Licht; Das Modell komponiert die Aufnahme, steuert die Bewegung und kann in einem Durchgang den passenden Ton hinzufügen.
Diese Seite behandelt den Nur-Text-Endpunkt der Wan 3.0-Familie. Da kein Bild hochgeladen werden muss, ist es eine schnelle Möglichkeit, einer Idee nachzugehen, eine Szene auszublenden oder eine fertige Kurzaufnahme allein aus Worten zu erstellen.
| Parameter | Erforderlich | Geben Sie | ein Standard | Sortiment / Optionen | Beschreibung |
|---|---|---|---|---|---|
| Eingabeaufforderung* | Ja (*) | Zeichenfolge | - | - | Szene, Motiv, Aktion, Kamera, Beleuchtung und Bewegung. |
| Auflösung | Nein | Zeichenfolge | 720p | 480p, 720p, 1080p | Ausgabeauflösungsstufe. |
| aspect_ratio | Nein | Zeichenfolge | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, adaptive | Ausgabe-Seitenverhältnis. |
| Dauer | Nein | Ganzzahl | 5 | 2-30 | Ausgabelänge in Sekunden. |
| thinking_mode | Nein | boolescher Wert | falsch | wahr / falsch | Tiefergehende Interpretation komplexer Eingabeaufforderungen. |
| enable_audio | Nein | boolescher Wert | wahr | wahr / falsch | Fügen Sie eine synchronisierte Audiospur hinzu. |
| Samen | Nein | Ganzzahl | zufällig | 0-2147483647 | Seed für reproduzierbare Ergebnisse. |
Der Preis hängt von der gewählten Auflösung ab: 0,06 $ pro Sekunde bei 480p, 0,12 $ pro Sekunde bei 720p und 0,25 $ pro Sekunde bei 1080p. Durch das Aktivieren oder Deaktivieren von Audio ändert sich die Rate nicht.
33 Gesichtsausdrücke, 400+ Bewegungen, filmisch inszenierte KI-Clips
Ersetzen Sie einen ausgewählten Bereich in einem Video mithilfe einer Maske oder Bereichsbeschreibung sowie optionalem Bild und Prompt.
Verwandeln Sie Standbilder mit Kamera- und Audiosteuerung in filmische Bewegungsclips.
Seedance 2.5: Kinoartiges KI-Video mit stärkerer Konsistenz und längeren Clips
Erstellen Sie mit einem Referenzbild und einem Quellvideo ein animiertes Video; Ausgabegröße und Seed sind wählbar.
Offene Text-zu-Video-Konvertierung mit 480p/768p und nativem Stereo-Audio.
Wan 3.0 Text To Video generiert einen kurzen Filmclip direkt aus einer schriftlichen Eingabeaufforderung, ohne dass ein Referenzbild erforderlich ist. Es eignet sich für die Vorvisualisierung von Konzepten, für Werbe- und Werbeaufnahmen sowie für Social-Media-Videos und ermöglicht es Ihnen, eine Idee allein aus Worten in wenigen Minuten zu visualisieren.
Der Text-zu-Video-Endpunkt beginnt nur mit einer Eingabeaufforderung, sodass das Modell die gesamte Szene zusammenstellt, während der Bild-zu-Video-Endpunkt einen bestimmten ersten Frame animiert, den Sie bereitstellen. Wählen Sie Wan 3.0 Text To Video, wenn das Modell den Bildausschnitt erfinden soll, und „Bild-zu-Video“, wenn Sie bereits die Eröffnungsaufnahme haben.
Wan 3.0 Text To Video folgt strukturierten Anweisungen, die das Motiv, die Aktion, die Kamerabewegung und die Beleuchtung benennen, und erzeugt eine kohärente, filmähnliche Bewegung. Klare, konkrete Eingabeaufforderungen mit einer einzigen Kamerarichtung pro Aufnahme führen im Allgemeinen zu den vorhersehbarsten Ergebnissen.
Es unterstützt die Ausgabe 480p, 720p und 1080p, eine Dauer von 2 bis 30 Sekunden und Seitenverhältnisse einschließlich 16:9, 9:16, 1:1, 4:3 und 3:4. Verwenden Sie 480p für schnelle Entwürfe und 1080p für die Lieferung; Überprüfen Sie das RunComfy-Panel auf die genauen Stromgrenzwerte.
Ja. Wan 3.0 Text To Video kann eine synchronisierte Audiospur mit dem Video generieren, und Sie können Audio für einen stillen Export deaktivieren. Das Aktivieren oder Deaktivieren von Audio hat keinen Einfluss auf den Preis.
Der Denkmodus ermöglicht eine bewusstere Interpretation der Eingabeaufforderung, was hilfreich sein kann, wenn eine Szene mehrere Aktionen, Themen oder Kompositionsregeln kombiniert. Es ist optional und standardmäßig deaktiviert, sodass Sie es für komplexe Eingabeaufforderungen aktivieren und für einfache deaktivieren können.
Ja. Sie können Wan 3.0 Text To Video in der Benutzeroberfläche des RunComfy-Modells prototypisieren und dann dasselbe Modell über RunComfy HTTP API mit denselben Parametern aufrufen. Dies erleichtert den Übergang von Browsertests zu einem automatisierten Produktionsworkflow.
Generationen verbrauchen je nach Auflösung und Dauer USD oder Credits: 0,06 $ pro Sekunde bei 480p, 0,12 $ pro Sekunde bei 720p und 0,25 $ pro Sekunde bei 1080p. Neue Benutzer erhalten in der Regel einen kostenlosen Testbetrag, um Wan 3.0 Text To Video zunächst zu testen.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





