Créez une image depuis un prompt et réglez LoRA, format, fichier et seed.
Ce modèle est conçu pour un travail simple : conserver l'identité, le cadrage et les performances d'un clip de tête parlante existant tout en remplaçant la piste parlée. Téléchargez une vidéo avec un visage clair et un fichier audio séparé, puis recevez un clip dont le mouvement de la bouche suit le nouveau dialogue.
Ce flux de travail convient au doublage, à la localisation et aux échanges de dialogues lorsque vous aimez déjà l'image et que vous n'avez besoin que des lèvres pour rattraper votre retard. Sur RunComfy, vous pouvez exécuter PixVerse Lipsync dans l'interface utilisateur du modèle ou via un HTTP API après le téléchargement du média.
| Paramètre | Obligatoire | Tapez | Par défaut | Gamme / Options | Descriptif |
|---|---|---|---|---|---|
| audio* | Oui (*) | chaîne | https://playgrounds-storage-public.runcomfy.net/tools/7454/media-files/input.mp3 | URI | URL de la piste audio qui génère le mouvement des lèvres. |
| vidéo* | Oui (*) | chaîne | https://playgrounds-storage-public.runcomfy.net/tools/7454/media-files/input.mp4 | URI | URL de la vidéo source avec un visage clairement visible. |
La facturation suit la durée de l'audio téléchargé. La durée est arrondie à la seconde entière. La durée minimale facturée est de 3 secondes et la durée maximale facturable est de 600 secondes.
| Tarif | Prix |
|---|---|
| --- | --- : |
| Offre à durée limitée | $0.02 par seconde d'audio |
| Régulier (après) | $0.04 par seconde d'audio |
[Offre à durée limitée] Moitié prix (50% de réduction). $0.02 par seconde d'audio (minimum 3 secondes facturées). Tarif normal après l'offre : $0.04 par seconde.
audio et video.Sur la base d’informations accessibles au public :
Créez une image depuis un prompt et réglez LoRA, format, fichier et seed.
MiniMax H3 Max Reference to video : références multimodales aux clips 480p/768p
FLUX 3 Draft Extend : brouillons de suite de clips rapides et à faible coût à 720p
Transformez des portraits fixes en vidéos expressives et réalistes avec contrôle et précision.
Restaurez et mettez à niveau une vidéo requise. Contrôlez la largeur de sortie, la limite d’images, la vitesse de lecture, la graine, les conseils de restauration et la taille du lot.
Prolongez une vidéo existante de 7 secondes en 720p, avec guidage par prompt et génération audio facultative.
PixVerse Lipsync remappe le mouvement de la bouche dans un clip de tête parlante existant afin qu'il corresponde à une piste audio de remplacement. Il est couramment utilisé pour le doublage, la localisation, les corrections de dialogue et les courtes mises à jour de style avatar sans nouvelle prise de vue.
PixVerse Lipsync nécessite une vidéo source avec un visage clairement visible et un fichier audio ou une URL pour le nouveau discours. Des images claires de face et un son clair produisent généralement le timing buccal le plus naturel.
PixVerse Lipsync se concentre sur l'alignement de la bouche basé sur l'audio pour une vidéo existante plutôt que sur la génération d'une nouvelle scène complète à partir d'une invite. Par rapport aux outils d'avatar plus larges, il s'agit d'une modification ciblée pour le remplacement et la localisation de la parole.
Vérifiez le panneau de paramètres RunComfy actuel pour connaître les limites exactes des fichiers. Sur la base des informations disponibles du fournisseur, gardez le visage de l’orateur visible et bien éclairé, et évitez une forte occlusion de la bouche pour une meilleure qualité de synchronisation.
Oui. Prototypez PixVerse Lipsync dans l'interface utilisateur du modèle RunComfy, puis appelez le même modèle via l'API RunComfy avec les mêmes paramètres audio et vidéo pour l'automatisation de la production.
Pendant cette offre à durée limitée, PixVerse Lipsync est à moitié prix à $0.02 par seconde d'audio, arrondi à la seconde entière supérieure, avec un minimum de 3 secondes et un maximum de 600 secondes. Le tarif normal après l'offre est de $0.04 par seconde.
Utilisez un son vocal sec et clair, adaptez la longueur audio au segment parlant et préférez la vidéo frontale avec tête parlante. Des pistes bruyantes, des angles de profil extrêmes ou des bouches couvertes réduisent la précision des lèvres.
Oui. PixVerse Lipsync aide les équipes à localiser les porte-parole, à actualiser les voix off des publicités et à adapter les clips de formation aux nouveaux scripts tout en conservant le cadrage et les performances d'origine.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





