logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Wan 3.0 Reference To Video: Multimodale Referenzvideogenerierung auf Models and API | RunComfy

wan-ai/wan-3.0/reference-to-video

Wan 3.0 Reference To Video kombiniert eine Eingabeaufforderung mit Bild-, Video- und Audioreferenzen, um zusammenhängende Clips mit einheitlichen Themen, Bewegungen und Ton zu erstellen.

Beschreiben Sie Szene, Motiv, Bewegung, Kamerabewegung, Beleuchtung und Stil. Beziehen Sie sich auf die Referenzen in der Reihenfolge Bild 1, Video 1, Audio 1.
Image 1
Bis zu 10 Referenzbilder für die Konsistenz von Motiv, Objekt oder Szene. Es ist mindestens eine Referenz (Bild, Video oder Audio) erforderlich.
Bis zu 5 Referenzvideos (MP4 oder MOV, jeweils 1–15 Sekunden, insgesamt nicht mehr als 15 Sekunden) zur Bewegungs- oder Szenenführung.
Bis zu 5 Referenz-Audioclips (insgesamt nicht länger als 15 Sekunden) zur Ton- oder Timingsteuerung.
Ausgabeauflösungsstufe. Verwenden Sie 480p für schnelle Entwürfe und 1080p für eine Ausgabe mit höherer Qualität.
Ausgabeseitenverhältnis des generierten Videos.
Länge des generierten Videos in Sekunden. Der Bereich liegt zwischen 2 und 30. Beginnen Sie mit der Iteration kurz und steigern Sie sie dann, sobald die Bewegung richtig aussieht.
When on, the model may rewrite your prompt for richer scene detail before generation. Turn off for faster turnaround if your prompt is already precise.
Wenn diese Option aktiviert ist, enthält das Ausgabevideo eine synchronisierte Audiospur. Für einen stummen Clip ausschalten.
Zufälliger Startwert für reproduzierbare Ergebnisse. Der Bereich liegt zwischen 0 und 2147483647.
Idle
The rate per counted second (generated video duration plus the combined duration of reference videos) is $0.049 for 480p, $0.099 for 720p, and $0.199 for 1080p. Image and audio references are not billed as duration.

Einführung in Wan 3.0 Reference To Video

Wan 3.0 Reference To Video stellt aus einer Eingabeaufforderung und multimodalen Referenzen, einschließlich Bildern, Videos und Audio, einen zusammenhängenden Clip mit einer Dauer von 2 bis 30 Sekunden und Kontrolle des Seitenverhältnisses zusammen. Es ersetzt fragiles Compositing durch referenzbasierte Konsistenz und hilft Studios, Werbeteams und Kreativen, Charaktere, Objekte, Bewegungen und Ton während einer Aufnahme markenkonform zu halten. Für Entwickler kann Wan 3.0 Reference To Video auf RunComfy sowohl im Browser als auch über einen HTTP API verwendet werden, sodass Sie das Modell nicht selbst hosten oder skalieren müssen.
Ideal für: Zeichenkonsistenz | Markenproduktszenen | Multimodales Storytelling

Wan-AI / Wan 3.0 Reference To Video#


Wan 3.0 Reference To Video nimmt eine Textaufforderung zusammen mit Referenzmedien und komponiert einen neuen Clip, der sie würdigt. Geben Sie Referenzbilder, Videos oder Audio an und zeigen Sie dann in der Eingabeaufforderung als Bild 1, Video 1 oder Audio 1 darauf, um zu steuern, wer erscheint, wie er sich bewegt und wie die Szene klingt.


Dieser Referenzendpunkt ist für Konsistenzarbeit konzipiert: wiederkehrende Charaktere, bestimmte Produkte, ein aus einem Clip übernommener Bewegungsstil oder ein in eine neue Aufnahme übertragenes Audiogefühl. Referenzen werden in der Reihenfolge abgeglichen, in der Sie sie angeben.


Highlights#


  • Multimodale Referenzen: Leiten Sie eine Aufnahme mit bis zu 10 Bildern, 5 Videos und 5 Audioclips.
  • Konsistenz des Themas: Sorgen Sie dafür, dass ein Charakter, ein Produkt oder ein Objekt im gesamten Clip erkennbar bleibt.
  • Bewegungs- und Timing-Hinweise: Leihen Sie sich Bewegung oder Tempo aus einem Referenzvideo aus.
  • Audioführung: Verwenden Sie Referenzaudio, um den Klang und Rhythmus des Ergebnisses zu steuern.
  • Flexible Ausgabe: Stellen Sie 2 bis 30 Sekunden ein und wählen Sie das Seitenverhältnis für die endgültige Platzierung.

Parameter#


ParameterErforderlichGeben Sieein StandardSortiment / OptionenBeschreibung
Eingabeaufforderung*Ja (*)Zeichenfolge--Szene, Motiv, Bewegung, Kamera, Beleuchtung und Stil.
reference_imagesBedingtArrayleerbis zu 10Referenzbilder für die Konsistenz von Motiv oder Szene.
reference_videosBedingtArrayleerbis zu 5Referenzvideos (jeweils 1–15 Sekunden, insgesamt 15 Sekunden).
reference_audiosBedingtArrayleerbis zu 5Referenzaudio (insgesamt 15 Sekunden).
AuflösungNeinZeichenfolge720p480p, 720p, 1080pAusgabeauflösungsstufe.
aspect_ratioNeinZeichenfolge16:916:9, 9:16, 1:1, 4:3, 3:4, adaptiveAusgabe-Seitenverhältnis.
DauerNeinGanzzahl52-30Ausgabelänge in Sekunden.
enable_audioNeinboolescher Wertwahrwahr / falschFügen Sie eine synchronisierte Audiospur hinzu.
SamenNeinGanzzahlzufällig0-2147483647Seed für reproduzierbare Ergebnisse.

Geben Sie mindestens eines von reference_images, reference_videos oder reference_audios an.


Preise#


Die Abrechnung erfolgt pro gezählter Sekunde: Ausgabedauer plus Gesamtdauer aller Referenzvideos. Preise: 0,049 $/s bei 480p, 0,099 $/s bei 720p und 0,199 $/s bei 1080p. Bild- und Audio-Referenzen werden nicht als Dauer berechnet. Audio ein/aus ändert den Preis nicht. Der Betrag vor dem Absenden ist eine Schätzung; die Endabrechnung erfolgt nach dem Lauf.

Verwandte Modelle

veo-3-1/fast/first-last-frame-to-video

Verwandle Bilder in filmische Clips mit Veo 3.1 Fast – schnell, kreativ und intuitiv.

ace-step/audio-inpaint

Bearbeite einen präzise gewählten Abschnitt einer Audiospur, ohne den Rest zu verändern.

hunyuan-video-v1.5/image-to-video

Animieren Sie ein Ausgangsbild per Prompt zu einem 5- oder 8-sekündigen Video in 480p oder 720p.

kling-1-6/pro/image-to-video

Präzise Eingaben, fließende Bewegungen, brillante Videoqualität.

pixverse-c1/transition

Animieren Sie einen kontrollierten Übergang zwischen den ausgewählten ersten und letzten Bildern.

video-background-removal/fast/video-to-video

Entfernen Sie Videohintergründe mit der Fast-Variante und steuern Sie Codec, Kantenverfeinerung und Motivtyp.

Häufig gestellte Fragen

Wofür wird Wan 3.0 Reference To Video verwendet?

Wan 3.0 Reference To Video erstellt einen Clip aus einer Textaufforderung in Kombination mit Referenzmedien wie Bildern, Videos und Audio. Es ist auf Konsistenzarbeit ausgelegt: Es soll eine Figur, ein Produkt oder ein Bewegungsstil in einer neuen Aufnahme erkennbar bleiben, anstatt sie von Hand zu komponieren.

Welche Arten von Referenzen kann Wan 3.0 Reference To Video akzeptieren?

Es akzeptiert bis zu 10 Referenzbilder, bis zu 5 Referenzvideos und bis zu 5 Referenzaudioclips in einer Anfrage. Bilder helfen dabei, die Identität zu sperren, Videos leiten Bewegung oder Tempo und Audio steuert den Ton, und Sie zeigen in der Eingabeaufforderung auf jedes Element als Bild 1, Video 1 oder Audio 1.

Wie sorgt Wan 3.0 Reference To Video dafür, dass die Themen konsistent bleiben?

Da Sie direkte visuelle Referenzen bereitstellen, kann Wan 3.0 Reference To Video das Erscheinungsbild einer Figur oder eines Objekts zuverlässiger in die generierte Szene übertragen als eine Eingabeaufforderung allein. Saubere Einzelsubjekt-Referenzbilder bieten im Allgemeinen die stärkste Identitätsfeststellung.

Welche Beschränkungen gelten für Referenzvideos und -audio?

Referenzvideos sollten im MP4- oder MOV-Format vorliegen und jeweils 1 bis 15 Sekunden lang sein, wobei die Gesamtdauer des Referenzvideos 15 Sekunden nicht überschreiten darf. Auch der Referenzton bleibt insgesamt etwa 15 Sekunden lang erhalten. Überprüfen Sie vor einem Lauf das Parameterfeld RunComfy auf die genauen Stromgrenzen.

Welche Ausgabeeinstellungen unterstützt Wan 3.0 Reference To Video?

Die Ausgabe ist bei 480p, 720p oder 1080p mit einer Dauer von 2 bis 30 Sekunden und Seitenverhältnissen wie 16:9, 9:16, 1:1, 4:3 und 3:4 verfügbar. Sie können auch eine synchronisierte Audiospur erstellen oder den Clip lautlos exportieren.

Wann sollte ich „Reference-to-Video“ statt „Image-to-Video“ verwenden?

Verwenden Sie Wan 3.0 Reference To Video, wenn Sie Konsistenz über mehrere Referenzen hinweg oder eine Mischung aus Bild-, Video- und Audioführung in einer Aufnahme benötigen. Verwenden Sie Bild-zu-Video, wenn Sie lediglich ein einzelnes erstes Bild animieren möchten, das Sie bereits haben.

Können Entwickler Wan 3.0 Reference To Video über die RunComfy-API verwenden?

Ja. Sie können Wan 3.0 Reference To Video in der Benutzeroberfläche des RunComfy-Modells prototypisieren und dann dasselbe Modell über RunComfy HTTP API mit identischen Parametern aufrufen. Dadurch bleibt Ihr referenzgesteuertes Setup zwischen Browsertests und Produktionsautomatisierung konsistent.

Wie viel kostet Wan 3.0 Reference To Video auf RunComfy?

Generationen verbrauchen USD oder Credits pro gezählter Sekunde: 0,049 $ bei 480p, 0,099 $ bei 720p und 0,199 $ bei 1080p. Gezählte Sekunden sind die fertige Ausgabe plus die Gesamtdauer aller Referenzvideos (Bilder und Audio werden nicht als Dauer berechnet). Da Referenzvideos nach dem Lauf gemessen werden, ist der Betrag vor dem Absenden eine Schätzung. Neue Benutzer erhalten in der Regel eine kostenlose Testversion, um Wan 3.0 Reference To Video vor größeren Auflagen auszuprobieren.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • Alle Modelle anzeigen →
Bildmodelle
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Beispiele für Wan 3.0 Reference To Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...