Erstellen Sie zwischen einem erforderlichen Start- und Endbild ein 5- oder 10-sekündiges Video. Steuern Sie den Übergang per Prompt mit @Image1 und @Image2.
live avatar generator wurde entwickelt, um ein einzelnes Porträt aus einer Audiospur zu animieren. Dadurch entsteht eine kohärente Gesprächssequenz, während die Identität, die Gesichtsstruktur und der Rahmen des Subjekts erhalten bleiben. Präzise Lippensynchronisation, natürliche Mikroausdrücke und stabile Bewegungen machen es für die wiederholbare Produktion mit verschiedenen Stimmen und Präsentationsstilen geeignet.
Hauptfunktionen:
Geben Sie image_url für das Motiv und audio_url für einen WAV- oder MP3-Track an und schreiben Sie dann eine klare Anweisung im Feld prompt, das den beabsichtigten Ausdruck, das Tempo und die Bewegungsgrenzen beschreibt. Jede num_clips-Einheit fügt ungefähr ein 3-Sekunden-Segment hinzu, während frames_per_clip die Bewegungsglätte steuert und ein Vielfaches von 4 sein muss. Erhöhen Sie guidance_scale, wenn das Ergebnis dem prompt genauer folgen muss, und verwenden Sie seed für wiederholbare Aufnahmen erneut. Für stabile Augenlinien und Gesichtsgeometrie verwenden Sie ein scharfes, nach vorne gerichtetes Porträt mit zentriertem Gesicht und schlichtem Hintergrund.
Beispiele:
Profi-Tipps:
Erstellen Sie zwischen einem erforderlichen Start- und Endbild ein 5- oder 10-sekündiges Video. Steuern Sie den Übergang per Prompt mit @Image1 und @Image2.
Animieren Sie ein Startbild mit Textsteuerung und wählen Sie Format, Auflösung, Dauer, Stil, Audio und Mehrclip-Modus.
Verlängern Sie vorhandene Clips mit szenenkonsistenter Bewegung über das letzte Bild hinaus
Cineastische 4K-Text-zu-Video-Generierung für 0,42 $ pro Sekunde Ausgabe.
Seedance 2.5 FLF2V 480p: Übergänge vom ersten zum letzten Frame-Entwurf zu geringeren Kosten
Gewichtet den Verweis auf Video anhand von Bild-, Video- und Audiohinweisen.
live avatar generator kombiniert ein Standporträt, eine WAV- oder MP3-Audiospur und das Feld prompt. Das Gesicht wird passend zur Sprache animiert, während prompt Ausdruck, Tempo und Bewegung vorgibt.
Es ist nützlich für Content-Creator, Lehrkräfte, Marketing- und Produktteams, die Talking-Head-Videos ohne einen vollständigen Videodreh erstellen möchten. Typische Anwendungen sind KI-Sprechervideos, Lerninhalte, Erklärvideos und Avatare für den Kundenkontakt.
Für Generierungen werden auf RunComfy Credits berechnet. Ein gegebenenfalls verfügbares Testguthaben und die Kosten der aktuellen Einstellungen werden vor dem Start in der RunComfy-Oberfläche angezeigt.
num_clips legt die ungefähre Dauer in etwa 3 Sekunden langen Segmenten fest, frames_per_clip steuert die Bewegungsglätte und muss ein Vielfaches von 4 sein, guidance_scale regelt die Treue zu prompt und seed hilft dabei, ein Ergebnis zu reproduzieren.
Dieser Endpunkt erfordert die Pflichtfelder image_url, audio_url und prompt; audio_url muss auf eine gültige WAV- oder MP3-Datei verweisen. Zurückgegeben wird ein animiertes Sprechvideo. Die Ausgabeauflösung wird vom Dienst bestimmt und ist nicht als Eingabeparameter verfügbar.
Dieser Endpunkt ist für ein Porträt und eine Audiospur pro Generation ausgelegt. Um eine Konversation mit mehreren Avataren aufzubauen, generieren Sie jeden Sprecher separat und kombinieren Sie die Clips in einem Editor.
Verwenden Sie ein scharfes, frontal aufgenommenes Porträt mit zentriertem Gesicht und schlichtem Hintergrund, stellen Sie sauberes Audio bereit und formulieren Sie im Feld prompt eine klare Anweisung zum gewünschten Ausdruck und zur Bewegung. Passen Sie guidance_scale schrittweise an, statt prompt mit zu vielen Anforderungen zu überladen.
Es ist für Gesichtsanimationen und Talking-Head-Aufnahmen optimiert, sodass Ganzkörper- oder gestenreiche Szenen weniger geeignet sind. Längere Sequenzen können stärker driften; verwenden Sie daher klare Ausgangsmedien und sinnvolle Clip-Einstellungen, um ein möglichst stabiles Ergebnis zu erzielen.
Sie können das Modell in der RunComfy-Browseroberfläche ausführen oder über die HTTP API integrieren. Die Generierung läuft in der Cloud; eine lokale Installation oder ein eigenes Hosting des Modells ist nicht erforderlich.
RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.