ByteDance Seed / Seedance 2.0 Pro#
Seedance 2.0 Pro ist ein multimodales Text-zu-Video-Modell von ByteDance Seed, das Szenenbeschreibungen und optionale Referenzen in kurze cineastische Clips umwandelt. Auf RunComfy steuern Sie die Generierung mit einem prompt sowie optionalen images (bis zu 9), videos (bis zu 3) und audio (bis zu 3) im multimodalen Referenzmodus. Zusätzlich lassen sich aspect ratio, duration, resolution, generate audio, seed und optionale tools festlegen, zum Beispiel [{ "type": "web_search" }], damit das Modell bei Bedarf online suchen kann.
Ausgabe in diesem Playground: 480p / 720p / 1080p / 4K wählbar · 4–15 Sekunden · Seitenverhältnisse adaptive (Standard), 16:9, 9:16, 4:3, 3:4, 1:1, 21:9 · optional nativer Ton, wenn Audio erzeugen aktiviert ist
Highlights#
- Multimodale Referenzen: Bis zu 9 Bilder, 3 Referenzvideos (je 2–15 s, mp4/mov) und 3 Audioreferenzen (2–15 s, wav/mp3, jeweils unter 15 MB) ergänzen einen klaren Text-Prompt.
- Flexibler Bildausschnitt: Mit adaptive wählt das Modell standardmäßig das nächstgelegene Format; feste Seitenverhältnisse stehen für plattformspezifische Ausgaben bereit.
- Video mit Ton: Aktivieren Sie Audio erzeugen, um Sprache, Soundeffekte und Musik synchron zum Clip zu erstellen.
- Steuerbare Länge: duration ist eine ganze Zahl von 4 bis 15 Sekunden; Standard sind 5 Sekunden.
- Reproduzierbarkeit: Legen Sie einen seed fest, wenn Ergebnisse beim Verfeinern von Prompt oder Referenzen wiederholbar bleiben sollen.
- Optionale Websuche: Übergeben Sie tools mit
type: web_search, damit das Modell bei Bedarf im Web recherchiert. Die Anzahl ausgeführter Suchen steht in der Aufgabenantwort unter usage.tool_usage.web_search.
Parameter von Seedance 2.0 Pro#
Die Eingaben entsprechen dem RunComfy-OpenAPI-Schema Input für diese Vorlage.
| Parameter | Erforderlich | Typ | Standard | Bereich / Optionen | Beschreibung |
|---|
| prompt* | Ja (*) | string | — | Chinesisch ~≤500 Zeichen, Englisch ~≤1000 Wörter empfohlen | Text-Prompt für das Video |
| image_url (Images) | Nein | array (Bild-URIs) | [] | 0–9 | jpeg, png, webp, bmp, tiff, gif |
| video_url (Videos) | Nein | array (Video-URIs) | [] | 0–3 | mp4, mov; 2–15 s pro Clip |
| audio_url (Audio URLs) | Nein | array (Audio-URIs) | [] | 0–3 | wav, mp3; 2–15 s, < 15 MB |
| aspect_ratio | Nein | string | adaptive | adaptive, 16:9, 9:16, 4:3, 3:4, 1:1, 21:9 | Das Modell wählt bei adaptive das nächstgelegene Format; das tatsächliche Verhältnis steht im Aufgabenergebnis |
| duration | Nein | integer | 5 | 4–15 Sekunden | Cliplänge in vollen Sekunden |
| resolution | Nein | string | 720p | 480p, 720p, 1080p, 4k | Voreinstellung für die Ausgabeauflösung |
| generate_audio | Nein | boolean | true | true / false | Bei true wird synchronisierter Ton mit Sprache, Soundeffekten und Musik erzeugt |
| seed | Nein | integer | — | — | Zufalls-Seed für die Videogenerierung |
| tools | Nein | array von Objekten | [] | nur type: web_search | Deklariert erlaubte Tools; mit web_search kann das Modell je nach Prompt suchen. Details stehen in der Aufgabenabfrage unter usage.tool_usage.web_search |
So verwenden Sie Seedance 2.0 Pro#
1) Szene beschreiben — Nennen Sie Motiv, Handlung, Umgebung, Stimmung, Beleuchtung und Kamera. Empfohlen werden etwa höchstens 500 chinesische Zeichen oder 1000 englische Wörter.
2) Referenzen hinzufügen (optional) — Laden Sie Bilder für Look oder Identität sowie kurze Referenzvideos oder Audiodateien hoch. Beachten Sie Dauer- und Größenlimits jeder Medienart.
3) Seitenverhältnis wählen — Nutzen Sie adaptive zum Erkunden oder ein festes Verhältnis wie 9:16 beziehungsweise 16:9 für ein bekanntes Ausgabeformat.
4) Dauer festlegen — Wählen Sie eine ganze Zahl zwischen 4 und 15 Sekunden.
5) Auflösung wählen — 480p für schnelle Entwürfe, 720p als ausgewogenen Standard, 1080p für hohe Details oder 4K für die schärfste Ausgabe.
6) Audio erzeugen — Lassen Sie die Option für Dialog, Soundeffekte oder Musik aktiviert; deaktivieren Sie sie für ein Video ohne Ton.
7) Seed festlegen (optional) — Fixieren Sie den Seed bei Iterationen, damit Änderungen vom Prompt oder den Medien und nicht vom Zufall stammen.
8) Websuche aktivieren (optional) — Fügen Sie tools [{ "type": "web_search" }] hinzu, wenn das Modell aktuelle Fakten nachschlagen darf. Eine ausgeführte Suche erhöht die Latenz; die Anzahl steht danach unter usage.tool_usage.web_search in der Aufgabenabfrage.
9) Generieren und verfeinern — Überarbeiten Sie die Formulierung, tauschen Sie Referenzen aus oder ändern Sie Seitenverhältnis, Dauer und Auflösung.
Tipps für Prompts und Referenzen mit Seedance 2.0 Pro#
- Beschreiben Sie Kamera und Bewegung präzise, zum Beispiel mittlere Nahaufnahme, langsame Kamerafahrt nach vorn, Handkamera oder statische Kamera.
- Verwenden Sie images für Elemente, die stabil bleiben müssen, etwa Gesicht, Kostüm oder Logo; mit text steuern Sie Handlung und Stimmung.
- Referenz-videos und audio müssen 2–15 Sekunden lang sein; eine Referenz-Audiodatei muss unter 15 MB bleiben.
- Nennen Sie bei aktiviertem generate_audio die gewünschte Dialogstimmung oder das Umgebungsgeräusch.
- Vereinfachen Sie den Prompt oder reduzieren Sie widersprüchliche Stilhinweise, wenn das Ergebnis unruhig oder inkonsistent wirkt.
Seedance 2.0 Pro im Vergleich zu anderen Modellen#
- Seedance 1.5 Pro: Seedance 2.0 Pro erweitert multimodale Referenzen, Dauersteuerung und cineastische Bewegung für kurze Clips. Vergleichen Sie beide mit demselben Prompt und denselben Referenzen.
- Wan 2.5 / Kling Video 2.6: Entscheiden Sie danach, ob Sie die Kombination aus Bild-, Video- und Audioreferenzen, für Lippensynchronität geeignete Audioerzeugung und die oben beschriebenen Parameter benötigen.
Weitere Modelle zum Ausprobieren#
- Seedance 1.5 Pro — Solide Lippensynchronität und Kurzform-Ergebnisse der vorherigen Generation.
- Seedance 1.0 — Einfache Ausgangsbasis für Text-zu-Video.
- Wan 2.5 — Leistungsfähige universelle Text-zu-Video-Alternative.
- Kling Video 2.6 — Stärken bei Bewegungsbearbeitung und referenzbasierten Actionszenen.
Kurz gesagt unterstützt Seedance 2.0 Pro auf RunComfy Text sowie bis zu 9 Bilder, 3 Videos und 3 Audioreferenzen, 4–15 s lange Clips, Voreinstellungen von 480p bis 4K, flexible Seitenverhältnisse einschließlich adaptive und optionalen nativen Ton – passend zu den aktuellen Playground-Feldern.