logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Kling Lipsync: Text und Stimme mit Video synchronisieren | RunComfy

kling/kling/lipsync/text-to-video

Text mit einer ausgewählten Stimme sprechen lassen und mit einem vorhandenen Video synchronisieren.

Unterstützt `.mp4` und `.mov`, höchstens 100 MB, 2–10 Sekunden, 720p oder 1080p sowie Breite und Höhe von 720–1920 Pixeln.
Text für die Sprach- und Lipsync-Erzeugung; höchstens 120 Zeichen.
Voice ID für die Spracherzeugung.
Zur Voice ID passende Sprache: `zh` oder `en`.
Sprechtempo von 0,8 bis 2.
Idle
The rate is $0.025 per second.

Kling Lipsync mit Text und wählbarer Stimme

Diese Kling-Lipsync-Variante erzeugt aus einem Text mit einer gewählten Voice ID eine Sprachspur und synchronisiert sie mit einem vorhandenen Video. Video, Text und Voice ID sind erforderlich. Sprache und Sprechtempo können zusätzlich eingestellt werden.

Kling Lipsync auf X: Beiträge aus der Community

Eingaben und Optionen#

  • video_url, text und voice_id sind erforderlich.
  • Das Video muss .mp4 oder .mov, höchstens 100 MB groß und 2–10 Sekunden lang sein. Es werden 720p oder 1080p sowie Breite und Höhe von jeweils 720–1920 Pixeln unterstützt.
  • text darf höchstens 120 Zeichen enthalten.
  • voice_id bietet 27 feste Werte; Standard ist genshin_vindi2.
  • voice_language bietet zh und en; Standard ist en.
  • voice_speed reicht von 0,8 bis 2; Standard ist 1.

Verfügbare Voice IDs#

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1


Praktischer Ablauf#

Wählen Sie eine Voice ID und eine passende Sprache, halten Sie den Text innerhalb von 120 Zeichen und passen Sie das Sprechtempo an die Videolänge an. Verwenden Sie kurze, eindeutig gesetzte Sätze und prüfen Sie Satzanfänge, Pausen, schnelle Silben und Kopfbewegungen in der Ausgabe.


Diese Variante enthält kein Feld für eine eigene Audiodatei.

Ähnliche Modelle

ltx-2-19b/image-to-video/lora

Verwandelt statische Bilder in ausdrucksstarke Videoclips mit synchronisiertem Ton.

luma-ray-2/text-to-video

Generieren Sie ein Video aus einer erforderlichen Text-Prompt. Wählen Sie sechs Seitenverhältnisse, `540p`, `720p` oder `1080p`, eine Dauer von `5` oder `9` Sekunden und optionale Schleifenwiedergabe.

ltx-2-19b/video-to-video/lora

Effiziente Videotransformation mit filmischer Bewegungs- und Designpräzision.

ace-step/audio-inpaint

Bearbeite einen präzise gewählten Abschnitt einer Audiospur, ohne den Rest zu verändern.

wan-2-6/video-to-video

Erstellen Sie ein Video aus einer Textaufforderung und ein bis drei Referenzclips mit Steuerelementen für Dauer, Ausgabegröße, Aufnahmestruktur, Startwert, negativer Aufforderung und Audiogenerierung.

pixverse/motion-control/mimic

Übertragen Sie Tanz- und Posenbewegungen aus dem Video auf ein Standbild.

Häufig gestellte Fragen

Was macht diese Kling-Lipsync-Variante?

Sie erzeugt aus Text eine Stimme und synchronisiert sie mit einem vorhandenen Video.

Welche Eingaben sind erforderlich?

video_url, text und voice_id sind erforderlich.

Welche Anforderungen gelten für das Video?

.mp4 oder .mov, höchstens 100 MB, 2–10 Sekunden, 720p oder 1080p sowie Breite und Höhe von 720–1920 Pixeln.

Wie lang darf der Text sein?

text darf höchstens 120 Zeichen enthalten.

Welche Voice IDs stehen zur Auswahl?

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1

Welche Voice ID ist voreingestellt?

Der Standardwert ist genshin_vindi2.

Welche Sprachwerte sind möglich?

voice_language bietet zh und en; Standard ist en.

Welcher Bereich gilt für das Sprechtempo?

voice_speed reicht von 0,8 bis 2; Standard ist 1.

Kann ich eine eigene Audiodatei hochladen?

Nein. Diese Variante besitzt kein Feld für eine Audio-URL.

Wie sollte ich den Text vorbereiten?

Verwenden Sie kurze, klar gesetzte Sätze und wählen Sie ein Tempo, das zur Länge des Videos passt.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • Alle Modelle anzeigen →
Bildmodelle
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Beispiele mit Kling Lipsync

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...