logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Kling Lipsync: Text und Stimme mit Video synchronisieren | RunComfy

kling/kling/lipsync/text-to-video

Text mit einer ausgewählten Stimme sprechen lassen und mit einem vorhandenen Video synchronisieren.

Unterstützt `.mp4` und `.mov`, höchstens 100 MB, 2–10 Sekunden, 720p oder 1080p sowie Breite und Höhe von 720–1920 Pixeln.
Text für die Sprach- und Lipsync-Erzeugung; höchstens 120 Zeichen.
Voice ID für die Spracherzeugung.
Zur Voice ID passende Sprache: `zh` oder `en`.
Sprechtempo von 0,8 bis 2.
Idle
The rate is $0.025 per second.

Kling Lipsync mit Text und wählbarer Stimme

Diese Kling-Lipsync-Variante erzeugt aus einem Text mit einer gewählten Voice ID eine Sprachspur und synchronisiert sie mit einem vorhandenen Video. Video, Text und Voice ID sind erforderlich. Sprache und Sprechtempo können zusätzlich eingestellt werden.

Kling Lipsync auf X: Beiträge aus der Community

Eingaben und Optionen#

  • video_url, text und voice_id sind erforderlich.
  • Das Video muss .mp4 oder .mov, höchstens 100 MB groß und 2–10 Sekunden lang sein. Es werden 720p oder 1080p sowie Breite und Höhe von jeweils 720–1920 Pixeln unterstützt.
  • text darf höchstens 120 Zeichen enthalten.
  • voice_id bietet 27 feste Werte; Standard ist genshin_vindi2.
  • voice_language bietet zh und en; Standard ist en.
  • voice_speed reicht von 0,8 bis 2; Standard ist 1.

Verfügbare Voice IDs#

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1


Praktischer Ablauf#

Wählen Sie eine Voice ID und eine passende Sprache, halten Sie den Text innerhalb von 120 Zeichen und passen Sie das Sprechtempo an die Videolänge an. Verwenden Sie kurze, eindeutig gesetzte Sätze und prüfen Sie Satzanfänge, Pausen, schnelle Silben und Kopfbewegungen in der Ausgabe.


Diese Variante enthält kein Feld für eine eigene Audiodatei.

Ähnliche Modelle

veo-3-1/fast/first-last-frame-to-video

Verwandle Bilder in filmische Clips mit Veo 3.1 Fast – schnell, kreativ und intuitiv.

pika-2-2/text-to-video

Erstelle mit Pika 2.2 hochwertige Videos aus Text-Prompts.

seedance-2.0-mini/video-to-video

Bearbeitet einen Quellclip per Text-Prompt und erzeugt auf Wunsch natives Audio.

kling-2-6/pro/text-to-video

Erstellen Sie aus einem Text-Prompt kurze Videos mit wählbarer Dauer, Bildformat und optionaler Tonspur.

hailuo-2-3/pro/image-to-video

Verwandle Standbilder in flüssige 1080p-Videos mit realistischer Tiefe und Stilkontrolle.

sora-2/text-to-video

Generieren Sie ein Video mit synchronisiertem Audio aus einer erforderlichen Textaufforderung. Wählen Sie `1280x720` oder `720x1280` und eine Dauer von `4`, `8` oder `12` Sekunden.

Häufig gestellte Fragen

Was macht diese Kling-Lipsync-Variante?

Sie erzeugt aus Text eine Stimme und synchronisiert sie mit einem vorhandenen Video.

Welche Eingaben sind erforderlich?

video_url, text und voice_id sind erforderlich.

Welche Anforderungen gelten für das Video?

.mp4 oder .mov, höchstens 100 MB, 2–10 Sekunden, 720p oder 1080p sowie Breite und Höhe von 720–1920 Pixeln.

Wie lang darf der Text sein?

text darf höchstens 120 Zeichen enthalten.

Welche Voice IDs stehen zur Auswahl?

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1

Welche Voice ID ist voreingestellt?

Der Standardwert ist genshin_vindi2.

Welche Sprachwerte sind möglich?

voice_language bietet zh und en; Standard ist en.

Welcher Bereich gilt für das Sprechtempo?

voice_speed reicht von 0,8 bis 2; Standard ist 1.

Kann ich eine eigene Audiodatei hochladen?

Nein. Diese Variante besitzt kein Feld für eine Audio-URL.

Wie sollte ich den Text vorbereiten?

Verwenden Sie kurze, klar gesetzte Sätze und wählen Sie ein Tempo, das zur Länge des Videos passt.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Alle Modelle anzeigen →
Bildmodelle
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Beispiele mit Kling Lipsync

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...