Verwandeln Sie Standporträts mit Kontrolle und Präzision in ausdrucksstarke, lebensechte Videos.
React-1 verarbeitet die erforderlichen Eingaben video_url und audio_url und erstellt daraus eine lippensynchrone Videobearbeitung. Beide Eingaben müssen 15 Sekunden oder kürzer sein. Sie können die Leistung mit emotion steuern, mit model_mode den Bearbeitungsbereich auswählen, mit lipsync_mode entscheiden, wie mit nicht übereinstimmenden Eingabelängen umgegangen wird, und mit temperature die Ausdruckskraft anpassen.
| Parameter | Erforderlich | Standard / Optionen | Was es steuert |
|---|---|---|---|
video_url | Ja | Beispielvideo-URL | Öffentliche URL für das Quellvideo; 15 Sekunden oder kürzer. |
audio_url | Ja | Beispielaudio-URL | Öffentliche URL für das Fahraudio; 15 Sekunden oder kürzer. |
emotion | Nein | Standard neutral | Genaue Werte: happy, angry, sad, neutral, disgusted, surprised. Es werden nur Ein-Wort-Emotionswerte unterstützt. |
model_mode | Nein | Standard face | Genaue Werte: lips, face, head. Legt den Bearbeitungsbereich und den Bewegungsumfang fest. |
lipsync_mode | Nein | Standard bounce | Genaue Werte: cut_off, loop, bounce, silence, remap. Steuert die Handhabung bei unterschiedlicher Audio- und Videodauer. |
temperature | Nein | Standard 0.5; 0–1 | Steuert die Ausdruckskraft der Lippensynchronisation. |
emotion und das am besten geeignete model_mode aus.lipsync_mode bewusst aus, wenn die Eingabelängen unterschiedlich sind, und passen Sie dann temperature in kleinen Schritten an.– Dieses Schema stellt keine Ausgabeauflösung, kein Seitenverhältnis, keine Bildrate, kein Dateiformat, keine Eingabeaufforderung, keinen Startwert oder keine Steuerung für mehrere Lautsprecher bereit.
– Die Seite bietet keine vergleichenden Benchmark-Daten und beschreibt nicht die zugrunde liegende Modellarchitektur.
Verwandeln Sie Standporträts mit Kontrolle und Präzision in ausdrucksstarke, lebensechte Videos.
Animieren Sie ein Startbild mit Textsteuerung und wählen Sie Format, Auflösung, Dauer, Stil, Audio und Mehrclip-Modus.
Cineastische Text-zu-Video-Generierung in Pro-Qualität für 0,112 $ pro Sekunde Ausgabe.
Seedance 2.5 Referenz 480p: Videoentwurf mit mehreren Referenzen zu geringeren Kosten
Stellen Sie aus 1–6 Bildern eine Szene zusammen und animieren Sie sie mit Pikascenes als Video.
Präzise Eingaben, fließende Bewegungen, brillante Videoqualität.
Auf dieser Seite wird React-1 als Video- und Audio-Lippensynchronisations-Workflow mit Steuerung für Emotionen, Bearbeitungsbereich, Nichtübereinstimmungsbehandlung und Ausdruckskraft dokumentiert. Es enthält keine Benchmark-Daten zu Lipsync-2 oder Lipsync-2-Pro, sodass relative Qualitäts- oder Identitätserhaltungsansprüche nicht allein anhand des Schemas bestätigt werden können.
Ja. Geben Sie den vorhandenen Clip über das erforderliche video_url und die Fahrspur über das erforderliche audio_url an. Beide müssen 15 Sekunden oder kürzer sein. Wählen Sie dann nach Bedarf emotion, model_mode, lipsync_mode und temperature aus.
Das Schema begrenzt die Eingaben video_url und audio_url auf jeweils 15 Sekunden. Ausgabeauflösung, Seitenverhältnis, Bildrate, Ausgabeformat, ControlNet oder IP-Adapter-Einstellungen werden nicht offengelegt, sodass auf dieser Seite keine Ansprüche auf 4K, 1080p und 16:9 gestellt werden.
Nein. Die dokumentierten Eingaben video_url und audio_url müssen jeweils 15 Sekunden oder kürzer sein. Das Schema beschreibt keinen längeren Sequenzmodus.
Verwenden Sie nach dem Testen der Einstellungen den RunComfy API-Endpunkt und senden Sie die gleichen dokumentierten Felder: video_url, audio_url, emotion, model_mode, lipsync_mode und temperature. Informationen zur Authentifizierung, Statusabfrage, Limits und Abrechnung finden Sie in der aktuellen API-Dokumentation.
emotion akzeptiert genau happy, angry, sad, neutral, disgusted oder surprised, mit neutral als Standard. model_mode legt den Bearbeitungsbereich fest und temperature passt die Ausdruckskraft zwischen 0 und 1 an. Das Schema dokumentiert keine spezifische Diffusions- oder Gesichtsgeometriemethode.
Verwenden Sie als praktische Anleitung einen kurzen Clip, bei dem das sprechende Gesicht und der sprechende Mund sichtbar sind, und sorgen Sie für einen klaren, endgültigen Ton. Starke Okklusion, sehr kleine Gesichter oder widersprüchliche Bewegungen können die Überprüfung erschweren, obwohl das Schema keine formalen Qualitätsschwellenwerte für diese Bedingungen veröffentlicht.
Diese Seite beginnt mit einem vorhandenen video_url und steuert audio_url und stellt dann Leistungskontrollen für die Lippensynchronisation bereit. Es bietet keine Text-zu-Video- oder Bild-zu-Video-Generierungsfelder zum Erstellen einer neuen Szene von Grund auf.
Die kommerzielle Nutzung hängt von den neuesten Synchronisierungs- und RunComfy-Bedingungen sowie von den Rechten am Quellvideo und -audio ab. Das Schema selbst gewährt keine universelle kommerzielle Lizenz; Überprüfen Sie die aktuelle Lizenzierung, bevor Sie sie kostenpflichtig oder öffentlich verbreiten.
Das bedeutet, dass Sie einen von sechs genauen emotion-Werten auswählen und den Bewegungsumfang auf lips, face oder head bis model_mode festlegen können. lipsync_mode behandelt Dauerunterschiede, während temperature die Ausdruckskraft anpasst. Über diese dokumentierten Kontrollen hinaus sollte keine umfassendere Leistungsfähigkeit abgeleitet werden.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





