logo
RunComfy
  • ComfyUI
  • EntraîneurNouveau
  • Modèles
  • API
  • Tarification
discord logo
MODÈLES
Explorer
Tous les modèles
BIBLIOTHÈQUE
Générations
APIS DE MODÈLES
Documentation API
Clés API
COMPTE
Utilisation

Omnihuman 1.5 : Générateur vidéo portrait et audio | RunComfy

bytedance/omnihuman/v1.5

Générez une vidéo à partir d'une image de portrait requise et d'une piste audio requise de moins de 35 secondes. Ajoutez des conseils facultatifs dans six langues prises en charge et utilisez le contrôle de départ, dont la valeur par défaut est -1.

URL obligatoire de l’image du portrait utilisée comme source visuelle.
0:00
0:00
URL obligatoire de l'audio qui pilote la vidéo. L'audio doit durer moins de 35 secondes.
Guide de génération facultatif. Langues prises en charge : chinois, anglais, japonais, coréen, espagnol du Mexique et indonésien.
Graine entière utilisée pour contrôler la génération ; par défaut : -1.
Idle
The rate is $0.18 per second.

Omnihuman 1.5

Omnihuman 1.5 génère une vidéo à partir de l'URL du portrait dans le champ requis `image_url` et de l'URL audio dans le champ requis `audio_url`. L'audio doit durer moins de 35 secondes. Utilisez le `prompt` facultatif pour obtenir des conseils de génération en chinois, anglais, japonais, coréen, espagnol du Mexique ou indonésien, et définissez `seed` si nécessaire ; sa valeur par défaut est -1.

Omnihuman 1.5 aperçu#


Omnihuman 1.5 utilise une image de portrait requise et une piste audio requise pour générer une vidéo. Les contrôles exposés sont limités aux deux URL sources, à un guide de texte facultatif et à une graine.


Entrées et contrôles#


  • image_url — Obligatoire. Fournissez l’URL directement accessible d’une image de portrait.
  • audio_url — Obligatoire. Fournissez l'URL directement accessible de l'audio qui pilote la vidéo ; elle doit durer moins de 35 secondes.
  • prompt — Texte d'orientation facultatif. Les langues prises en charge sont le chinois, l'anglais, le japonais, le coréen, espagnol du Mexique et indonésien.
  • seed — Graine entière pour la génération. La valeur par défaut est -1.

Flux de travail suggéré#


  1. Ajoutez une URL d'image de portrait à image_url.
  2. Ajoutez une URL audio à audio_url et confirmez que la piste dure moins de 35 secondes.
  3. Si nécessaire, saisissez des instructions concises dans prompt en utilisant l'une des six langues prises en charge.
  4. Définissez seed lorsque vous avez besoin d'un contrôle de départ explicite, puis soumettez la demande.

Le schéma d'entrée n'expose pas les contrôles de résolution de sortie, de rapport hauteur/largeur, de fréquence d'images ou de format de sortie.

Modèles associés

infinite-talk/fast

Générez une vidéo à partir d’une piste audio et d’une image, avec prompt et seed facultatifs.

minimax-h3/text-to-video

MiniMax H3 : texte-vidéo 768p/2K avec audio stéréo natif

veo-3/text-to-video

Créez une vidéo avec Google Veo 3 à partir d’un prompt et choisissez si l’audio doit être généré.

wan-2-6/flash/image-to-video

Créez des scènes vidéo réalistes à partir d’images fixes avec mouvement, synchronisation des dialogues et contrôle créatif flexible.

seedance-1-0/pro/fast/text-to-video

Générez des vidéos saisissantes à partir de texte avec une vitesse inégalée.

wan-2-2/text-to-video

Créez avec Wan 2.2 Plus une vidéo de cinq secondes depuis un prompt et choisissez format, seed et extension du prompt.

Questions Fréquemment Posées

Que fait Omnihuman 1.5 ?

Il génère une vidéo à partir de l'URL de portrait requise dans image_url et de l'URL audio requise dans audio_url, avec un guidage prompt et un contrôle seed en option.

Quels champs sont obligatoires ?

image_url et audio_url sont requis. prompt et seed sont des contrôles facultatifs.

Que dois-je fournir dans `image_url` ?

Fournissez une URL directement accessible pour une image de portrait à utiliser comme source visuelle.

Quelle est la limite de durée audio ?

L'audio fourni via audio_url doit durer moins de 35 secondes.

Quelles langues puis-je utiliser dans `prompt` ?

prompt prend en charge le chinois, l'anglais, le japonais, le coréen, espagnol du Mexique et indonésien.

Comment fonctionne `seed` ?

seed est un contrôle entier dont la valeur par défaut est -1.

Que dois-je vérifier avant de soumettre les fichiers sources ?

Confirmez que image_url et audio_url sont directement accessibles et que l'audio dure moins de 35 secondes.

Quels contrôles de sortie sont exposés ?

Le schéma d'entrée n'expose pas les champs de résolution de sortie, de rapport hauteur/largeur, de fréquence d'images ou de format de sortie.

Quelle est la liste de contrôle de la demande finale ?

Fournissez image_url et audio_url, gardez l'audio sous 35 secondes, utilisez une langue prise en charge si vous ajoutez prompt et vérifiez seed avant de soumettre.

Suivez-nous
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • Email
  • État du système
  • affilié
Modèles vidéo
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • Voir tous les modèles →
Modèles d'images
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • Voir tous les modèles →
Légal
  • Conditions d'utilisation
  • Politique de confidentialité
  • Politique relative aux cookies
RunComfy
Droits d'auteur 2026 RunComfy. Tous droits réservés.

RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.

Omnihuman 1.5 exemples

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...