logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Infinite Talk Multi-Person: zwei Audiospuren zu Video | RunComfy

community/infinite-talk/fast/multi

Zwei Audiospuren mit einem Bild verbinden und die Sprecherreihenfolge steuern.

0:00
0:00
Audiospur der linken Person; sie muss kürzer als 10 Minuten sein.
0:00
0:00
Audiospur der rechten Person; sie muss kürzer als 10 Minuten sein.
Quellbild für das Ausgabenvideo.
Optionale Textanweisung für die Generierung.
`meanwhile` spielt beide Spuren gleichzeitig ab; `left_right` links vor rechts; `right_left` rechts vor links.
Seed für die Generierung. Bei -1 wird ein zufälliger Seed verwendet.
Idle
The rate is $0.015 per second.

Infinite Talk Multi-Person im Überblick

Diese Infinite-Talk-Variante verwendet ein Bild und zwei getrennte Audiospuren. `left_audio` ist der linken, `right_audio` der rechten Person zugeordnet. Mit `order` bestimmen Sie, ob beide Spuren gleichzeitig oder nacheinander abgespielt werden; Prompt und Seed sind optional.

Eingaben#

  • left_audio, right_audio und image sind erforderlich.
  • Beide Audiospuren müssen laut Schema kürzer als 10 Minuten sein.
  • prompt ist optional und kann gewünschte Bewegung oder Einschränkungen beschreiben.
  • order bietet meanwhile, left_right und right_left; Standard ist left_right.
  • seed reicht von -1 bis 2147483647. Der Standardwert -1 wählt einen zufälligen Seed.

Bedeutung von order#

  • meanwhile: Beide Audiospuren spielen gleichzeitig.
  • left_right: Erst die linke, dann die rechte Spur.
  • right_left: Erst die rechte, dann die linke Spur.

Praktischer Ablauf#

Verwenden Sie ein Bild, in dem die Zuordnung zu links und rechts eindeutig ist. Prüfen Sie die beiden Audiodateien vorab und wählen Sie anschließend die passende Reihenfolge. Lassen Sie seed für neue Varianten auf -1 oder nutzen Sie zum Vergleichen einen festen Wert. Diese Oberfläche enthält keine Einstellung für Auflösung oder Ausgabedauer.

Ähnliche Modelle

kling-video-o3/pro/reference-to-video

Referenzbasierte Videogenerierung in Pro-Qualität: 3–15 Sekunden ab 0,112 $ pro Sekunde.

wan-2.7/edit-video

KI-gestützte Videotransformation mit stabiler Bewegung und präziser Gestaltungskontrolle.

elevenlabs/music-generation

Erstelle Songs per Prompt, mit 44,1-kHz-WAV-Ausgabe und gezielter Bearbeitung einzelner Abschnitte.

ltx-2-19b/text-to-video/lora

Erstellt aus Prompts synchronisierte Videoclips mit präziser Audio- und LoRA-Stilsteuerung.

wan-2-2/lora/text-to-image

Erzeugen Sie aus einem Prompt ein Bild und steuern Sie LoRAs, Bildgröße, Format, Steps, negativen Prompt und Seed.

kling/lipsync/text-to-video

Erzeugen Sie Sprache aus Text und synchronisieren Sie sie mit einem vorhandenen Video; Stimme, Sprache und Sprechtempo sind wählbar.

Häufig gestellte Fragen

Was macht Infinite Talk Multi-Person?

Das Modell erzeugt aus einem Bild und zwei getrennten Audiospuren ein Video und ordnet die Spuren der linken beziehungsweise rechten Person zu.

Welche Eingaben sind erforderlich?

left_audio, right_audio und image sind erforderlich.

Wie werden die Audiospuren den Personen zugeordnet?

left_audio gehört zur linken, right_audio zur rechten Person im Bild.

Wie lang dürfen die Audiospuren sein?

Laut Schema muss jede der beiden Audiospuren kürzer als 10 Minuten sein.

Was bewirkt `meanwhile`?

Bei meanwhile werden beide Audiospuren gleichzeitig abgespielt.

Was bedeuten `left_right` und `right_left`?

left_right spielt zuerst links und dann rechts; right_left kehrt diese Reihenfolge um.

Welcher Wert ist für `order` voreingestellt?

Der Standardwert ist left_right.

Ist ein Prompt erforderlich?

Nein. prompt ist optional und kann die gewünschte Bewegung oder Einschränkungen beschreiben.

Welchen Bereich hat der Seed?

seed reicht von -1 bis 2147483647. Der Standardwert -1 steht für einen zufälligen Seed.

Kann ich Auflösung oder Dauer einstellen?

Nein. Das veröffentlichte Schema dieser Seite enthält dafür keine Eingabefelder.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Alle Modelle anzeigen →
Bildmodelle
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Beispiele mit Infinite Talk Multi-Person

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...