logo
RunComfy
  • ComfyUI
  • EntraîneurNouveau
  • Modèles
  • API
  • Tarification
discord logo
MODÈLES
Explorer
Tous les modèles
BIBLIOTHÈQUE
Générations
APIS DE MODÈLES
Documentation API
Clés API
COMPTE
Utilisation

PixVerse Lipsync : synchronisation labiale et doublage vidéo du visage sur Models and API | RunComfy

pixverse/pixverse/lipsync

PixVerse Lipsync prend une vidéo de visage ainsi qu'une nouvelle piste vocale et renvoie une vidéo synchronisée sur les lèvres pour le doublage et la localisation.

0:00
0:00
URL de la piste audio qui génère le mouvement des lèvres sur la vidéo du visage source.
URL de la vidéo source avec un visage clairement visible et bien éclairé pour la synchronisation labiale.
Idle
[Launch Offer] Half price (50% off). $0.02 per second of audio, rounded up to the next whole second, with a 3-second minimum (max 600 seconds). Regular rate after launch: $0.04 per second.

Introduction à PixVerse Lipsync

Le PixVerse Lipsync de PixVerse Lipsync remappe le mouvement de la bouche sur une vidéo de visage existante pour correspondre à une nouvelle piste audio pour le doublage et le remplacement des dialogues. En échangeant les reprises et les montages bouche image par image contre une seule passe vidéo et audio, PixVerse Lipsync aide les spécialistes du marketing, les équipes de localisation et les créateurs à actualiser les lignes parlées sans reconstruire le plan. Pour les développeurs, PixVerse Lipsync sur RunComfy peut être utilisé à la fois dans le navigateur et via un HTTP API, vous n'avez donc pas besoin d'héberger ou de mettre à l'échelle le modèle vous-même.
Idéal pour : Doublage de films | Localisation de la campagne | Remplacement des dialogues

PixVerse / PixVerse Lipsync#


Ce modèle est conçu pour un travail simple : conserver l'identité, le cadrage et les performances d'un clip de tête parlante existant tout en remplaçant la piste parlée. Téléchargez une vidéo avec un visage clair et un fichier audio séparé, puis recevez un clip dont le mouvement de la bouche suit le nouveau dialogue.


Ce flux de travail convient au doublage, à la localisation et aux échanges de dialogues lorsque vous aimez déjà l'image et que vous n'avez besoin que des lèvres pour rattraper votre retard. Sur RunComfy, vous pouvez exécuter PixVerse Lipsync dans l'interface utilisateur du modèle ou via un HTTP API après le téléchargement du média.


Faits saillants#


  • Mouvement de la bouche piloté par le son : PixVerse Lipsync détermine les formes des lèvres à partir de votre piste de remplacement au lieu d'inventer un nouveau discours à partir du seul texte.
  • Conserve les performances de la source : L'identité, l'éclairage et le cadrage de la caméra restent proches de la prise de vue originale pendant que la bouche est resynchronisée.
  • Flux de travail à deux entrées : Fournissez uniquement une URL vidéo et une URL audio – pas de mode de résolution ni de boutons de style supplémentaires à régler.
  • Boucle prête pour le doublage : Utile lorsque vous localisez des publicités, remplacez des lignes ou échangez des langues sans reconstituer le talent.
  • Appel à génération unique : Une fois les téléchargements terminés, une requête produit la sortie vidéo synchronisée.

Paramètres#


ParamètreObligatoireTapezPar défautGamme / OptionsDescriptif
audio*Oui (*)chaînehttps://playgrounds-storage-public.runcomfy.net/tools/7454/media-files/input.mp3URIURL de la piste audio qui génère le mouvement des lèvres.
vidéo*Oui (*)chaînehttps://playgrounds-storage-public.runcomfy.net/tools/7454/media-files/input.mp4URIURL de la vidéo source avec un visage clairement visible.

Tarifs#


La facturation suit la durée de l'audio téléchargé. La durée est arrondie à la seconde entière. La durée minimale facturée est de 3 secondes et la durée maximale facturable est de 600 secondes.


TarifPrix ​​
------ :
Offre à durée limitée$0.02 par seconde d'audio
Régulier (après)$0.04 par seconde d'audio

[Offre à durée limitée] Moitié prix (50% de réduction). $0.02 par seconde d'audio (minimum 3 secondes facturées). Tarif normal après l'offre : $0.04 par seconde.


Comment utiliser#


  1. Ouvrez la page PixVerse Lipsync sur RunComfy et choisissez le modèle Vidéo vers vidéo.
  2. Téléchargez ou collez une URL vidéo où le visage de l'orateur est visible, bien éclairé et pratiquement dégagé autour de la bouche.
  3. Téléchargez ou collez l'URL audio qui doit générer le nouveau mouvement des lèvres.
  4. Confirmez que les deux champs sont remplis : le modèle attend uniquement ces deux entrées.
  5. Démarrez la génération et attendez la fin du passage vidéo à vidéo.
  6. Prévisualisez le résultat, puis téléchargez ou transmettez l'URL de sortie à votre prochaine étape de modification.
  7. Si le timing en bouche semble doux, supprimez les silences bruyants de l'audio et réessayez avec une prise plus nette.
  8. Pour utiliser l'API, téléchargez d'abord le média, puis appelez generate avec les mêmes champs audio et video.

Conseils d'invite et de référence#


  • Clarté du visage : Préférez les prises de vue frontales ou quasi frontales afin que PixVerse Lipsync puisse se verrouiller sur la bouche de manière fiable.
  • Éclairage : Même la lumière sur le visage bat les ombres épaisses sur les lèvres.
  • Occlusions : Évitez les mains, les microphones ou les cheveux couvrant la bouche pendant de longues périodes.
  • Qualité audio : Une parole claire avec un bruit de fond limité permet une synchronisation plus précise que les pistes boueuses.
  • Planification de la durée : Les courts clips de dialogue sont plus faciles à revoir ; rappelez-vous que la facturation est arrondie et plancher à 3 secondes.
  • Match intent : utilisez un son dont le rythme correspond aux performances à l'écran pour que la bouche synchronisée semble naturelle.
  • Appareil photo stable : Le bougé de la main est acceptable avec modération, mais un flou de mouvement extrême autour du visage peut affaiblir l'alignement.

Comment PixVerse Lipsync se compare aux autres modèles#


Sur la base d’informations accessibles au public :


  • Contre. outils de tête parlante basés sur du texte : Ce chemin part d'images réelles et d'un fichier audio fini, il remplace donc les lèvres d'une performance existante au lieu de synthétiser un avatar complet à partir d'un script.
  • Contre. systèmes d'image en vidéo parlante : ces outils animent généralement un portrait fixe ; PixVerse Lipsync attend une vidéo source en mouvement et se concentre sur le resynchronisation de la bouche.
  • Contre. éditeurs vidéo génératifs complets : des modèles vidéo plus larges réécrivent les scènes à partir d'invites ; ici, la portée reste étroite : synchronisez les lèvres avec l'audio tout en préservant la prise de vue.
  • Quand le choisir : Choisissez ce modèle lorsque la photo est déjà approuvée et que seule la piste parlée doit changer.

Modèles associés

wan-2-2/lora/text-to-image

Créez une image depuis un prompt et réglez LoRA, format, fichier et seed.

minimax-h3-max/reference-to-video

MiniMax H3 Max Reference to video : références multimodales aux clips 480p/768p

flux-3/extend-video/draft

FLUX 3 Draft Extend : brouillons de suite de clips rapides et à faible coût à 720p

live-avatar

Transformez des portraits fixes en vidéos expressives et réalistes avec contrôle et précision.

seedvr2/upscale/video

Restaurez et mettez à niveau une vidéo requise. Contrôlez la largeur de sortie, la limite d’images, la vitesse de lecture, la graine, les conseils de restauration et la taille du lot.

veo-3-1/extend-video

Prolongez une vidéo existante de 7 secondes en 720p, avec guidage par prompt et génération audio facultative.

Questions Fréquemment Posées

À quoi sert PixVerse Lipsync dans les flux de travail vidéo vers vidéo ?

PixVerse Lipsync remappe le mouvement de la bouche dans un clip de tête parlante existant afin qu'il corresponde à une piste audio de remplacement. Il est couramment utilisé pour le doublage, la localisation, les corrections de dialogue et les courtes mises à jour de style avatar sans nouvelle prise de vue.

De quelles entrées PixVerse Lipsync a-t-il besoin pour générer une vidéo synchronisée sur les lèvres ?

PixVerse Lipsync nécessite une vidéo source avec un visage clairement visible et un fichier audio ou une URL pour le nouveau discours. Des images claires de face et un son clair produisent généralement le timing buccal le plus naturel.

Comment PixVerse Lipsync se compare-t-il aux autres modèles de synchronisation labiale sur RunComfy ?

PixVerse Lipsync se concentre sur l'alignement de la bouche basé sur l'audio pour une vidéo existante plutôt que sur la génération d'une nouvelle scène complète à partir d'une invite. Par rapport aux outils d'avatar plus larges, il s'agit d'une modification ciblée pour le remplacement et la localisation de la parole.

Quelles limites de saisie dois-je connaître avant d'utiliser PixVerse Lipsync ?

Vérifiez le panneau de paramètres RunComfy actuel pour connaître les limites exactes des fichiers. Sur la base des informations disponibles du fournisseur, gardez le visage de l’orateur visible et bien éclairé, et évitez une forte occlusion de la bouche pour une meilleure qualité de synchronisation.

Les développeurs peuvent-ils utiliser PixVerse Lipsync via l'API RunComfy ?

Oui. Prototypez PixVerse Lipsync dans l'interface utilisateur du modèle RunComfy, puis appelez le même modèle via l'API RunComfy avec les mêmes paramètres audio et vidéo pour l'automatisation de la production.

Combien coûte la génération avec PixVerse Lipsync sur RunComfy ?

Pendant cette offre à durée limitée, PixVerse Lipsync est à moitié prix à $0.02 par seconde d'audio, arrondi à la seconde entière supérieure, avec un minimum de 3 secondes et un maximum de 600 secondes. Le tarif normal après l'offre est de $0.04 par seconde.

Quels conseils qualité améliorent les PixVerse Lipsync résultats ?

Utilisez un son vocal sec et clair, adaptez la longueur audio au segment parlant et préférez la vidéo frontale avec tête parlante. Des pistes bruyantes, des angles de profil extrêmes ou des bouches couvertes réduisent la précision des lèvres.

PixVerse Lipsync est-il adapté aux équipes produit, publicitaires et e-learning ?

Oui. PixVerse Lipsync aide les équipes à localiser les porte-parole, à actualiser les voix off des publicités et à adapter les clips de formation aux nouveaux scripts tout en conservant le cadrage et les performances d'origine.

Suivez-nous
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • Email
  • État du système
  • affilié
Modèles vidéo
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • Voir tous les modèles →
Modèles d'images
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • Voir tous les modèles →
Légal
  • Conditions d'utilisation
  • Politique de confidentialité
  • Politique relative aux cookies
RunComfy
Droits d'auteur 2026 RunComfy. Tous droits réservés.

RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.

Exemples de PixVerse Lipsync

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...