logo
RunComfy
  • ComfyUI
  • EntraîneurNouveau
  • Modèles
  • API
  • Tarification
discord logo
MODÈLES
Explorer
Tous les modèles
BIBLIOTHÈQUE
Générations
APIS DE MODÈLES
Documentation API
Clés API
COMPTE
Utilisation

live avatar generator : Création vidéo photoréaliste Lip-Sync | RunComfy

community/live-avatar

Transformez un portrait fixe et une piste audio en une vidéo parlante photoréaliste avec une synchronisation labiale précise, des mouvements du visage expressifs et des commandes pratiques pour une production reproductible.

Il doit s'agir d'une URL d'image valide. Le personnage de cette image sera animé.
0:00
0:00
Doit être une URL audio valide (WAV ou MP3). L'avatar est animé pour correspondre à cet audio.
Chaque clip dure environ 3 secondes. Des valeurs plus élevées créent des vidéos plus longues.
Doit être un multiple de 4. Des valeurs plus élevées produisent des résultats plus fluides mais prennent plus de temps à générer.
Des valeurs plus élevées suivent l'invite de plus près.
Idle
The rate is $0.01 per second.

Introduction à Live Avatar Generator

live avatar generator transforme un portrait fixe et une piste audio WAV ou MP3 en une vidéo parlante photoréaliste avec une synchronisation labiale précise et des mouvements du visage expressifs. Un prompt ciblé vous permet de guider l'expression, le rythme et le mouvement. Conçu pour les créateurs, les équipes marketing, les enseignants et les développeurs, il remplace un flux de travail complexe de tournage et d'animation par un pipeline image-vidéo rapide. Sur RunComfy, vous pouvez utiliser live avatar generator dans votre navigateur ou via le HTTP API sans héberger ni mettre à l'échelle le modèle vous-même.

Idéal pour : Vidéos des porte-parole de l'IA | Narration d'apprentissage en ligne | Avatars interactifs

Ce qui distingue live avatar generator#

live avatar generator est conçu pour animer un seul portrait à partir d'une piste audio. Il crée une séquence parlante cohérente tout en préservant l'identité, la structure du visage et le cadrage du sujet. Une synchronisation labiale précise, des micro-expressions naturelles et un mouvement stable le rendent adapté à une production reproductible sur différentes voix et styles de présentation.


Capacités clés :

  • Préservation de la structure : conserve l'identité, la pose et les repères du visage à travers les images.
  • Fidélité de synchronisation labiale : aligne les formes de la bouche avec l'audio fourni à un timing précis.
  • Mouvement expressif : ajoute des clignements naturels, de petits mouvements de tête et des changements de regard avec une dérive minimale.
  • Sortie fluide : frames_per_clip doit être un multiple de 4 ; des valeurs plus élevées peuvent améliorer la fluidité mais prennent plus de temps à générer.
  • Contrôle de la production : num_clips contrôle la durée, guidance_scale contrôle la fidélité au prompt et seed aide à reproduire une prise.
  • Entrée flexible : prend en charge des recadrages de portraits variés et l'audio WAV ou MP3.

Guide d'invite pour live avatar generator#

Fournissez image_url pour le sujet et audio_url pour une piste WAV ou MP3, puis écrivez un prompt ciblé décrivant l'expression, le rythme et les limites de mouvement prévus. Chaque unité num_clips ajoute environ un segment de 3 secondes, tandis que frames_per_clip contrôle la fluidité du mouvement et doit être un multiple de 4. Augmentez guidance_scale lorsque le résultat doit suivre de plus près le prompt et réutilisez seed pour des prises répétables. Pour des lignes des yeux et une géométrie du visage stables, utilisez un portrait net, orienté vers l'avant, avec le visage centré et l'arrière-plan simple.


Exemples :

  • "Preserve identity and camera framing; neutral studio lighting; subtle head nods and natural blinks; align to audio."
  • "Keep background unchanged; focus motion on mouth and eyes; no head rotation; live avatar generator follows the audio pace."
  • "Confident, upbeat delivery; small smiles on emphasized words; keep gaze at camera; avoid shoulder movement."
  • "Serious tone; minimal facial movement; maintain lip precision; increase frames_per_clip to 64 for smoother motion."
  • "Editorial look; soft key light from left; micro-expressions only; live avatar generator keeps structure and pose intact."

Conseils de pro :

  • Dites clairement ce qui doit rester inchangé et ce qui peut bouger.
  • Utilisez des repères spatiaux tels que la gauche, la droite ou l'arrière-plan uniquement pour localiser le mouvement.
  • Utilisez un portrait net et haute résolution et supprimez les distractions.
  • Préférez quelques instructions fortes à un prompt surchargé ; ajustez guidance_scale progressivement.
  • Définissez d'abord num_clips et frames_per_clip, puis réglez le style et seed.

Modèles associés

seedance-1.0/text-to-video

Créez une vidéo avec Seedance 1.0 depuis un prompt et choisissez résolution, rapport d’image et durée.

veo-3/fast/text-to-video

Transformez du texte en clips courts avec sons et effets en un rien de temps

ltx-2/fast/text-to-video

Générez une vidéo 16:9 à partir d’un prompt textuel, avec durée, résolution, fréquence d’images et audio au choix.

seedance-2.5/reference-to-video/480p

Seedance 2.5 Référence 480p : Draft vidéo multi-références à moindre coût

gemini-omni-flash/reference-to-video

Créez une courte vidéo avec son synchronisé à partir d’images de référence et d’une invite.

kling-3.0/standard/text-to-video

Créez des films multi-scènes avec des dialogues synchronisés et des personnages cohérents. Use Kling 3.0 on RunComfy.

Questions Fréquemment Posées

Qu'est-ce que live avatar generator et comment fonctionne son processus de conversion d'image en vidéo ?

live avatar generator combine un portrait fixe, une piste audio WAV ou MP3 et le champ prompt. Il anime le visage au rythme de la voix fournie, tandis que prompt guide l’expression, le rythme et les mouvements.

À qui profite le plus live avatar generator ?

Il est utile aux créateurs, enseignants, équipes marketing et équipes produit qui souhaitent réaliser des vidéos face caméra sans organiser un tournage complet. Les usages courants comprennent les porte-parole virtuels, les cours, les vidéos explicatives et les avatars destinés à la relation client.

L'utilisation de live avatar generator est-elle gratuite ?

Les générations sur RunComfy consomment des crédits. Tout crédit d’essai disponible ainsi que le coût des réglages actuels sont affichés dans l’interface RunComfy avant le lancement.

Quels contrôles live avatar generator fournit-il ?

num_clips définit la durée approximative par segments d’environ 3 secondes, frames_per_clip contrôle la fluidité du mouvement et doit être un multiple de 4, guidance_scale règle la fidélité au prompt et seed aide à reproduire un résultat.

Quelles entrées live avatar generator accepte-t-il ?

Ce point de terminaison nécessite un image_url valide, un audio_url valide pour une piste WAV ou MP3 et un prompt. Il renvoie une vidéo parlante animée ; la résolution de sortie est déterminée par le service plutôt que par un paramètre d'entrée exposé.

Puis-je créer une conversation avec plusieurs avatars en une seule génération ?

Ce point de terminaison est conçu pour un portrait et une piste audio par génération. Pour créer une conversation multi-avatar, générez chaque intervenant séparément et combinez les clips dans un éditeur.

Comment puis-je améliorer la qualité de sortie ?

Utilisez un portrait net de face avec un visage centré et un arrière-plan simple, fournissez un son clair et rédigez un prompt ciblé décrivant l'expression et le mouvement souhaités. Ajustez le guidance_scale progressivement au lieu de surcharger le prompt.

Quelles sont les principales limitations de live avatar generator ?

Il est optimisé pour l’animation faciale et les plans face caméra ; il convient donc moins aux scènes en pied ou riches en gestes. Les séquences longues peuvent aussi présenter davantage de dérive ; utilisez des médias sources nets et des réglages de clip raisonnables pour obtenir un résultat plus stable.

Où puis-je utiliser live avatar generator ?

Vous pouvez exécuter le modèle dans l’interface web de RunComfy ou l’intégrer via la HTTP API. La génération s’effectue dans le cloud ; aucune installation ni aucun hébergement local du modèle n’est nécessaire.

Suivez-nous
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • Email
  • État du système
  • affilié
Modèles vidéo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Voir tous les modèles →
Modèles d'images
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Voir tous les modèles →
Légal
  • Conditions d'utilisation
  • Politique de confidentialité
  • Politique relative aux cookies
RunComfy
Droits d'auteur 2026 RunComfy. Tous droits réservés.

RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.

Exemples de Live Avatar Generator en action

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...