Erzeugen Sie Videos zwischen Start- und Endbildern mit optionalem Audio
Happy Horse 1.1 reference to video ist der referenzgesteuerte Modus von Alibabas nativ multimodalem Videomodell. Sie stellen ein oder mehrere Referenzbilder sowie eine Textbeschreibung bereit. Daraus erzeugt das Modell einen kurzen Clip, der Motiv, Stil oder Komposition der Vorlagen aufgreift und in einem Durchlauf Bewegung und synchronisierten Ton ergänzt.
Der Modus nutzt dieselbe Architektur wie die übrige Happy Horse 1.1-Familie. Dadurch entstehen physikalisch plausible Bewegungen, eine nuancierte Darstellung von Licht und Schatten sowie filmische Kamerafahrten wie Push-ins, Pull-outs und Fokusverlagerungen. Figuren bleiben über den gesamten Clip hinweg wiedererkennbar; stilistisch reicht das Spektrum von fotorealistischem Filmmaterial bis zu illustrativer Animation.
Gegenüber Generation 1.0 wurde Happy Horse gezielt weiterentwickelt: Bewegungen wirken dynamischer und besitzen mehr Gewicht. Gleichzeitig hält das Modell die Ähnlichkeit bei einem breiteren Spektrum von Motiven – darunter asiatische Gesichter – zuverlässiger und erzeugt weniger Morphing-Artefakte.
Ausgabeformat: Auflösung: 720P oder 1080P / fps: 24 / Dauer: 3-15s / Seitenverhältnis: 16:9, 9:16, 1:1 / Audio: enthalten
Erzeugen Sie Videos zwischen Start- und Endbildern mit optionalem Audio
Erstellen Sie filmische Clips besonders schnell — mit multimodalen Referenzen, Lippensynchronisation und Kamerasteuerung.
Entfernen Sie den Hintergrund eines Videos und stimmen Sie Codec sowie Farbsaum-Unterdrückung auf die Weiterverarbeitung ab.
Gestalten Sie ein vorhandenes Video mit Textanweisungen neu und behalten Sie dabei die Quellbewegung und die Gesamtkomposition bei.
Erstellen Sie ein Avatar-Video aus einer erforderlichen Bild- und Audiodatei, mit einem optionalen Prompt zur Unterstützung bei der Generierung.
Erstellen Sie ein lippensynchrones Video aus den erforderlichen Video- und Audio-URLs mit fünf Modi für den Umgang mit nicht übereinstimmenden Eingabedauern.
Happy Horse 1.1 reference to video erzeugt einen kurzen Clip auf Grundlage Ihrer Referenzbilder. Motiv, Stil oder Komposition der Vorlagen bleiben dadurch im Ergebnis erhalten. Der Modus eignet sich für konsistente Figuren, Produktpräsentationen und markentypische Clips, bei denen die Bewegung einem bestimmten visuellen Erscheinungsbild folgen soll.
text-to-video erzeugt einen Clip ausschließlich aus einem Prompt. Happy Horse 1.1 reference to video verankert das Ergebnis dagegen mit bis zu 9 Referenzbildern und ergänzt anschließend die Bewegung. Das ist besonders hilfreich, wenn Identität, Produktdesign oder ein bestimmter Stil über das gesamte Video hinweg konsistent bleiben müssen.
Gegenüber der Vorgängerversion bietet Happy Horse 1.1 reference to video dynamischere Bewegungen, weniger Morphing-Artefakte und eine stabilere Ähnlichkeit bei unterschiedlichen Motiven, darunter asiatische Gesichter. Nach öffentlich verfügbaren Angaben wirken zuvor eher träge Handlungen nun kraftvoller und schwungvoller.
Ja. Dialoge, Umgebungsgeräusche und Foley-Effekte werden zusammen mit dem Bild in einem Durchlauf erzeugt und auf die Handlung abgestimmt. Dadurch ist kein separater Sounddesign-Schritt erforderlich.
Sie können bis zu 9 Referenzbilder bereitstellen; das erste Bild dient als wichtigste Vorlage. Ergänzen Sie weitere Bilder nur dann, wenn sie einen eigenen Zweck erfüllen, etwa ein zweites Motiv oder eine zusätzliche Stilreferenz. Zulässige Formate und aktuelle Grenzwerte finden Sie direkt bei den Einstellungen auf der RunComfy-Modellseite.
Happy Horse 1.1 reference to video erzeugt 3 bis 15 Sekunden lange Clips in 720P oder 1080P. Als Seitenverhältnis stehen 16:9, 9:16 und 1:1 zur Wahl. Nutzen Sie 720P für günstigere Testläufe und 1080P für die finale Ausgabe; einzelne Grenzwerte können je nach Modus oder Anbieter variieren.
Ja. Sie können Referenzen, Prompt und weitere Einstellungen zunächst im RunComfy AI Playground testen und das Modell anschließend mit denselben Parametern über die RunComfy-API automatisiert oder produktiv aufrufen. So bleibt Ihre getestete Konfiguration bei der Integration unverändert.
Abgerechnet wird nach Laufzeit und Auflösung: 720P kostet $0.13 pro Sekunde, 1080P $0.16 pro Sekunde. Ein 5-Sekunden-Clip kostet damit etwa $0.65 in 720P beziehungsweise $0.80 in 1080P. Die Kosten werden vom RunComfy-Guthaben abgezogen; neue Benutzer erhalten in der Regel ein kostenloses Testguthaben.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.





