logo
RunComfy
  • ComfyUI
  • EntrenadorNuevo
  • Modelos
  • API
  • Precios
discord logo
MODELOS
Explorar
Todos los modelos
BIBLIOTECA
Generaciones
APIS DE MODELOS
Documentación de la API
Claves API
CUENTA
Uso

Omnihuman 1.5: Generador de vídeo con retrato y audio | RunComfy

bytedance/omnihuman/v1.5

Genere un vídeo a partir de una imagen de retrato requerida y una pista de audio requerida de menos de 35 segundos. Agregue orientación opcional en seis idiomas admitidos y utilice el control inicial, cuyo valor predeterminado es -1.

URL obligatoria de la imagen de retrato utilizada como fuente visual.
0:00
0:00
URL requerida del audio que controla el vídeo. El audio debe tener una duración inferior a 35 segundos.
Guía de generación opcional. Idiomas admitidos: chino, inglés, japonés, coreano, español de México y indonesio.
Semilla entera utilizada para controlar la generación; predeterminado: -1.
Idle
The rate is $0.18 per second.

Omnihuman 1.5

Omnihuman 1.5 genera un vídeo a partir de la URL del retrato en el campo requerido `image_url` y la URL del audio en el campo requerido `audio_url`. El audio debe tener una duración inferior a 35 segundos. Utilice el `prompt` opcional para obtener orientación de generación en chino, inglés, japonés, coreano, español de México o indonesio, y configure `seed` cuando sea necesario; su valor predeterminado es -1.

Omnihuman 1.5 descripción general#


Omnihuman 1.5 utiliza una imagen de retrato requerida y una pista de audio requerida para generar un video. Los controles expuestos se limitan a las dos URL de origen, una guía de texto opcional y una semilla.


Entradas y controles#


  • image_url: obligatorio. Proporcione la URL directamente accesible de una imagen de retrato.
  • audio_url: obligatorio. Proporcione la URL directamente accesible del audio que controla el vídeo; debe ser inferior a 35 segundos.
  • prompt — Texto de orientación opcional. Los idiomas admitidos son chino, inglés, japonés, coreano, español de México y indonesio.
  • seed — Semilla entera para generación. El valor predeterminado es -1.

Flujo de trabajo sugerido#


  1. Agregue una URL de imagen de retrato a image_url.
  2. Agregue una URL de audio a audio_url y confirme que la pista dure menos de 35 segundos.
  3. Si es necesario, ingrese una guía concisa en prompt usando uno de los seis idiomas admitidos.
  4. Configure seed cuando necesite un control de semillas explícito y luego envíe la solicitud.

El esquema de entrada no expone la resolución de salida, la relación de aspecto, la velocidad de fotogramas ni los controles de formato de salida.

Modelos relacionados

wan-2.7/reference-to-video

Transforma referencias visuales o de audio en clips HD con control preciso del movimiento.

minimax-h3/image-to-video

Anima una imagen del primer fotograma a un vídeo de 768p o 2K durante hasta 15 segundos

wan-2-2/lora/text-to-video

Crea un vídeo desde un prompt y controla LoRA, resolución, relación de aspecto, fotogramas, FPS, pasos y seed.

video-background-removal/fast/video-to-video

Elimina fondos con la variante Fast y configura códec, refinado de bordes y tipo de sujeto.

ace-step/text-to-audio

Genera canciones de hasta 4 minutos con voces y letras a partir de etiquetas de estilo.

hunyuan/video-to-video

Da un nuevo estilo a un video existente con Tencent Hunyuan Video.

Preguntas Frecuentes

¿Qué hace Omnihuman 1.5?

Genera un vídeo a partir de la URL vertical requerida en image_url y la URL de audio requerida en audio_url, con guía prompt opcional y control seed.

¿Qué campos son obligatorios?

Tanto image_url como audio_url son necesarios. prompt y seed son controles opcionales.

¿Qué debo proporcionar en `image_url`?

Proporcione una URL de acceso directo para que una imagen de retrato se utilice como fuente visual.

¿Cuál es el límite de duración del audio?

El audio suministrado a través de audio_url debe ser inferior a 35 segundos.

¿Qué idiomas puedo usar en `prompt`?

prompt admite chino, inglés, japonés, coreano, español de México y indonesio.

¿Cómo funciona `seed`?

seed es un control entero cuyo valor predeterminado es -1.

¿Qué debo verificar antes de enviar los archivos fuente?

Confirme que image_url y audio_url sean accesibles directamente y que el audio dure menos de 35 segundos.

¿Qué controles de salida están expuestos?

El esquema de entrada no expone los campos de resolución de salida, relación de aspecto, velocidad de cuadros o formato de salida.

¿Cuál es la lista de verificación de solicitud final?

Proporcione image_url y audio_url, mantenga el audio por debajo de 35 segundos, use un idioma admitido si agrega prompt y revise seed antes de enviarlo.

Síguenos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Soporte
  • Discord
  • Correo electrónico
  • Estado del sistema
  • afiliado
Modelos de Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos los modelos →
Modelos de Imagen
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos los modelos →
Legal
  • Términos de servicio
  • Política de privacidad
  • Política de cookies
RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.

Omnihuman 1.5 ejemplos

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...