Synchronisez une piste audio avec une vidéo et choisissez si la vidéo doit être répétée.
Omnihuman 1.5 utilise une image de portrait requise et une piste audio requise pour générer une vidéo. Les contrôles exposés sont limités aux deux URL sources, à un guide de texte facultatif et à une graine.
image_url — Obligatoire. Fournissez l’URL directement accessible d’une image de portrait.audio_url — Obligatoire. Fournissez l'URL directement accessible de l'audio qui pilote la vidéo ; elle doit durer moins de 35 secondes.prompt — Texte d'orientation facultatif. Les langues prises en charge sont le chinois, l'anglais, le japonais, le coréen, espagnol du Mexique et indonésien.seed — Graine entière pour la génération. La valeur par défaut est -1.image_url.audio_url et confirmez que la piste dure moins de 35 secondes.prompt en utilisant l'une des six langues prises en charge.seed lorsque vous avez besoin d'un contrôle de départ explicite, puis soumettez la demande.Le schéma d'entrée n'expose pas les contrôles de résolution de sortie, de rapport hauteur/largeur, de fréquence d'images ou de format de sortie.
Synchronisez une piste audio avec une vidéo et choisissez si la vidéo doit être répétée.
Transformez un portrait et une piste audio en une vidéo d'avatar parlant, avec un prompt facultatif pour guider les mouvements ou la manière de parler.
Créez une vidéo animée à partir d’une image de référence et d’une vidéo source, avec choix du format de sortie et du seed.
Générez plus rapidement des clips cinématographiques avec des références multimodales, la synchronisation labiale et le contrôle de la caméra.
Transitions fluides, mouvements cohérents et rendu vidéo de qualité.
Anime une photo fixe en vidéo fluide 720P ou 1080P à partir d’un seul prompt.
Il génère une vidéo à partir de l'URL de portrait requise dans image_url et de l'URL audio requise dans audio_url, avec un guidage prompt et un contrôle seed en option.
image_url et audio_url sont requis. prompt et seed sont des contrôles facultatifs.
Fournissez une URL directement accessible pour une image de portrait à utiliser comme source visuelle.
L'audio fourni via audio_url doit durer moins de 35 secondes.
prompt prend en charge le chinois, l'anglais, le japonais, le coréen, espagnol du Mexique et indonésien.
seed est un contrôle entier dont la valeur par défaut est -1.
Confirmez que image_url et audio_url sont directement accessibles et que l'audio dure moins de 35 secondes.
Le schéma d'entrée n'expose pas les champs de résolution de sortie, de rapport hauteur/largeur, de fréquence d'images ou de format de sortie.
Fournissez image_url et audio_url, gardez l'audio sous 35 secondes, utilisez une langue prise en charge si vous ajoutez prompt et vérifiez seed avant de soumettre.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.




