logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Kling Lipsync: Text und Stimme mit Video synchronisieren | RunComfy

kling/kling/lipsync/text-to-video

Text mit einer ausgewählten Stimme sprechen lassen und mit einem vorhandenen Video synchronisieren.

Unterstützt `.mp4` und `.mov`, höchstens 100 MB, 2–10 Sekunden, 720p oder 1080p sowie Breite und Höhe von 720–1920 Pixeln.
Text für die Sprach- und Lipsync-Erzeugung; höchstens 120 Zeichen.
Voice ID für die Spracherzeugung.
Zur Voice ID passende Sprache: `zh` oder `en`.
Sprechtempo von 0,8 bis 2.
Idle
The rate is $0.025 per second.

Kling Lipsync mit Text und wählbarer Stimme

Diese Kling-Lipsync-Variante erzeugt aus einem Text mit einer gewählten Voice ID eine Sprachspur und synchronisiert sie mit einem vorhandenen Video. Video, Text und Voice ID sind erforderlich. Sprache und Sprechtempo können zusätzlich eingestellt werden.

Kling Lipsync auf X: Beiträge aus der Community

Eingaben und Optionen#

  • video_url, text und voice_id sind erforderlich.
  • Das Video muss .mp4 oder .mov, höchstens 100 MB groß und 2–10 Sekunden lang sein. Es werden 720p oder 1080p sowie Breite und Höhe von jeweils 720–1920 Pixeln unterstützt.
  • text darf höchstens 120 Zeichen enthalten.
  • voice_id bietet 27 feste Werte; Standard ist genshin_vindi2.
  • voice_language bietet zh und en; Standard ist en.
  • voice_speed reicht von 0,8 bis 2; Standard ist 1.

Verfügbare Voice IDs#

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1


Praktischer Ablauf#

Wählen Sie eine Voice ID und eine passende Sprache, halten Sie den Text innerhalb von 120 Zeichen und passen Sie das Sprechtempo an die Videolänge an. Verwenden Sie kurze, eindeutig gesetzte Sätze und prüfen Sie Satzanfänge, Pausen, schnelle Silben und Kopfbewegungen in der Ausgabe.


Diese Variante enthält kein Feld für eine eigene Audiodatei.

Ähnliche Modelle

wan-2-6/video-to-video

Erstellen Sie ein Video aus einer Textaufforderung und ein bis drei Referenzclips mit Steuerelementen für Dauer, Ausgabegröße, Aufnahmestruktur, Startwert, negativer Aufforderung und Audiogenerierung.

seedance-2.0/fast

Erstellen Sie filmische Clips besonders schnell — mit multimodalen Referenzen, Lippensynchronisation und Kamerasteuerung.

minimax-h3/text-to-video

MiniMax H3: 768p/2K Text-to-Video mit nativem Stereo-Audio

pixverse/v5.5/text-to-video

Generieren Sie aus einem erforderlichen Text-Prompt ein Video mit präzisen Einstellungen für Seitenverhältnis, Auflösung, Dauer, Stil, Seed, Audio, mehrere Clips und Prompt-Optimierung.

kling-2-6/motion-control-standard

KI-gesteuertes Bewegungskonvertierungstool, das eine präzise und stabile Animationserstellung ermöglicht

seedance-2.5/text-to-video/480p

Seedance 2.5 480p: Schnelle, kostengünstige Text-zu-Video-Entwürfe aus Eingabeaufforderungen

Häufig gestellte Fragen

Was macht diese Kling-Lipsync-Variante?

Sie erzeugt aus Text eine Stimme und synchronisiert sie mit einem vorhandenen Video.

Welche Eingaben sind erforderlich?

video_url, text und voice_id sind erforderlich.

Welche Anforderungen gelten für das Video?

.mp4 oder .mov, höchstens 100 MB, 2–10 Sekunden, 720p oder 1080p sowie Breite und Höhe von 720–1920 Pixeln.

Wie lang darf der Text sein?

text darf höchstens 120 Zeichen enthalten.

Welche Voice IDs stehen zur Auswahl?

genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1

Welche Voice ID ist voreingestellt?

Der Standardwert ist genshin_vindi2.

Welche Sprachwerte sind möglich?

voice_language bietet zh und en; Standard ist en.

Welcher Bereich gilt für das Sprechtempo?

voice_speed reicht von 0,8 bis 2; Standard ist 1.

Kann ich eine eigene Audiodatei hochladen?

Nein. Diese Variante besitzt kein Feld für eine Audio-URL.

Wie sollte ich den Text vorbereiten?

Verwenden Sie kurze, klar gesetzte Sätze und wählen Sie ein Tempo, das zur Länge des Videos passt.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • Alle Modelle anzeigen →
Bildmodelle
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Beispiele mit Kling Lipsync

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...