Retirez les arrière-plans avec la variante Fast et réglez le codec, les contours et le type de sujet.
React-1 prend les video_url et audio_url requis et crée une vidéo avec synchronisation labiale. Les deux entrées doivent durer 15 secondes ou moins. Vous pouvez orienter l’interprétation avec emotion, choisir la portée d'édition avec model_mode, décider de la manière dont les longueurs d'entrée incompatibles sont traitées avec lipsync_mode et ajuster l'expressivité avec temperature.
| Paramètre | Obligatoire | Par défaut / options | Ce qu'il contrôle |
|---|---|---|---|
video_url | Oui | URL vidéo d’exemple | URL publique de la vidéo source ; 15 secondes ou moins. |
audio_url | Oui | URL audio d’exemple | URL publique pour l'audio de conduite ; 15 secondes ou moins. |
emotion | Non | Par défaut neutral | Valeurs exactes : happy, angry, sad, neutral, disgusted, surprised. Seules les valeurs d'émotion d'un seul mot sont prises en charge. |
model_mode | Non | Par défaut face | Valeurs exactes : lips, face, head. Définit la région d'édition et la portée du mouvement. |
lipsync_mode | Non | Par défaut bounce | Valeurs exactes : cut_off, loop, bounce, silence, remap. Contrôle la gestion lorsque les durées audio et vidéo diffèrent. |
temperature | Non | Par défaut 0.5; 0–1 | Contrôle l’expressivité de la synchronisation labiale. |
emotion exact et le model_mode approprié le plus étroit.lipsync_mode lorsque les longueurs d'entrée diffèrent, puis ajustez temperature par petites étapes.Retirez les arrière-plans avec la variante Fast et réglez le codec, les contours et le type de sujet.
Restaurez et mettez à niveau une vidéo requise. Contrôlez la largeur de sortie, la limite d’images, la vitesse de lecture, la graine, les conseils de restauration et la taille du lot.
Générez une vidéo avec un audio synchronisé à partir d'une invite de texte requise. Choisissez `1280x720` ou `720x1280` et une durée de `4`, `8` ou `12` secondes.
Créez des vidéos de qualité cinéma à partir d'images grâce à l'IA
Transformez vos images en vidéos réalistes grâce à la puissance de l'IA Veo 3.1.
Ajoutez avec Pikadditions une personne ou un objet provenant d’une image dans une vidéo existante.
Cette page documente React-1 en tant que flux de travail de synchronisation labiale vidéo et audio avec des contrôles d'émotion, de portée d'édition, de gestion des discordances et d'expressivité. Il n'inclut pas de données de référence par rapport à Lipsync-2 ou Lipsync-2-Pro, de sorte que les allégations de qualité relative ou de préservation de l'identité ne peuvent pas être confirmées à partir du seul schéma.
Oui. Fournissez le clip existant via requis video_url et la piste de conduite via requis audio_url. Les deux doivent durer 15 secondes ou moins. Choisissez ensuite emotion, model_mode, lipsync_mode et temperature selon vos besoins.
Le schéma limite les entrées video_url et audio_url à 15 secondes chacune. Il n'expose pas les paramètres de résolution de sortie, de rapport hauteur/largeur, de fréquence d'images, de format de sortie, de ControlNet ou d'adaptateur IP, donc les revendications 4K, 1080p et 16:9 ne sont pas établies par cette page.
Non. Les entrées documentées video_url et audio_url doivent chacune durer 15 secondes ou moins. Le schéma ne décrit pas de mode de séquence plus longue.
Après avoir testé les paramètres, utilisez le RunComfy point de terminaison de l'API et envoyez les mêmes champs documentés : video_url, audio_url, emotion, model_mode, lipsync_mode et temperature. Consultez la documentation actuelle de l'API pour l'authentification, l'interrogation d'état, les limites et la facturation.
emotion accepte exactement happy, angry, sad, neutral, disgusted ou surprised, avec neutral par défaut. model_mode définit la portée d'édition et temperature ajuste l'expressivité entre 0 et 1. Le schéma ne documente pas une méthode spécifique de diffusion ou de géométrie faciale.
À titre de conseil pratique, utilisez un court clip où le visage et la bouche qui parlent sont visibles, et fournissez un son final clair. Une occlusion importante, des visages très petits ou des mouvements contradictoires peuvent rendre la révision plus difficile, bien que le schéma ne publie pas de seuils de qualité formels pour ces conditions.
Cette page part d'un video_url existant et d'un audio_url pilote, puis expose les contrôles de performances de synchronisation labiale. Il n'offre pas de champs de génération texte-vidéo ou image-vidéo pour créer une nouvelle scène à partir de zéro.
L'utilisation commerciale dépend des dernières conditions de synchronisation et de RunComfy ainsi que des droits sur la source vidéo et audio. Le schéma lui-même n'accorde pas de licence commerciale universelle ; vérifier la licence actuelle avant la distribution payante ou publique.
Cela signifie que vous pouvez choisir l'une des six valeurs exactes emotion et définir la portée de mouvement sur lips, face ou head jusqu'à model_mode. lipsync_mode gère les inadéquations de durée, tandis que temperature ajuste l'expressivité. Aucune capacité de performance plus large ne devrait être déduite au-delà de ces contrôles documentés.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





