logo
RunComfy
  • ComfyUI
  • EntrenadorNuevo
  • Modelos
  • API
  • Precios
discord logo
MODELOS
Explorar
Todos los modelos
BIBLIOTECA
Generaciones
APIS DE MODELOS
Documentación de la API
Claves API
CUENTA
Uso

Omnihuman 1.5: Generador de vídeo con retrato y audio | RunComfy

bytedance/omnihuman/v1.5

Genere un vídeo a partir de una imagen de retrato requerida y una pista de audio requerida de menos de 35 segundos. Agregue orientación opcional en seis idiomas admitidos y utilice el control inicial, cuyo valor predeterminado es -1.

URL obligatoria de la imagen de retrato utilizada como fuente visual.
0:00
0:00
URL requerida del audio que controla el vídeo. El audio debe tener una duración inferior a 35 segundos.
Guía de generación opcional. Idiomas admitidos: chino, inglés, japonés, coreano, español de México y indonesio.
Semilla entera utilizada para controlar la generación; predeterminado: -1.
Idle
The rate is $0.18 per second.

Omnihuman 1.5

Omnihuman 1.5 genera un vídeo a partir de la URL del retrato en el campo requerido `image_url` y la URL del audio en el campo requerido `audio_url`. El audio debe tener una duración inferior a 35 segundos. Utilice el `prompt` opcional para obtener orientación de generación en chino, inglés, japonés, coreano, español de México o indonesio, y configure `seed` cuando sea necesario; su valor predeterminado es -1.

Omnihuman 1.5 descripción general#


Omnihuman 1.5 utiliza una imagen de retrato requerida y una pista de audio requerida para generar un video. Los controles expuestos se limitan a las dos URL de origen, una guía de texto opcional y una semilla.


Entradas y controles#


  • image_url: obligatorio. Proporcione la URL directamente accesible de una imagen de retrato.
  • audio_url: obligatorio. Proporcione la URL directamente accesible del audio que controla el vídeo; debe ser inferior a 35 segundos.
  • prompt — Texto de orientación opcional. Los idiomas admitidos son chino, inglés, japonés, coreano, español de México y indonesio.
  • seed — Semilla entera para generación. El valor predeterminado es -1.

Flujo de trabajo sugerido#


  1. Agregue una URL de imagen de retrato a image_url.
  2. Agregue una URL de audio a audio_url y confirme que la pista dure menos de 35 segundos.
  3. Si es necesario, ingrese una guía concisa en prompt usando uno de los seis idiomas admitidos.
  4. Configure seed cuando necesite un control de semillas explícito y luego envíe la solicitud.

El esquema de entrada no expone la resolución de salida, la relación de aspecto, la velocidad de fotogramas ni los controles de formato de salida.

Modelos relacionados

ace-step/audio-outpaint

Amplía una pista de audio al principio, al final o en ambos extremos manteniendo su estilo.

ltx-2.5/audio-to-video/pro

LTX 2.5 Pro audio a vídeo para finales de 1080p cronometradas en pista

luma-ray-2/text-to-video

Genere un video a partir de un prompt de texto obligatorio. Elija seis relaciones de aspecto, `540p`, `720p` o `1080p`, una duración de `5` o `9` segundos y bucle opcional.

hailuo-2-3/pro/text-to-video

Crea videos 1080p desde texto con IA realista, capturando movimiento y emoción con precisión artística.

wan-2.7/image-to-video

Convierte imágenes estáticas en clips fluidos con control de audio.

pixverse-v6/text-to-video

Genera videos multi-clips dirigidos a partir de indicaciones con audio opcional.

Preguntas Frecuentes

¿Qué hace Omnihuman 1.5?

Genera un vídeo a partir de la URL vertical requerida en image_url y la URL de audio requerida en audio_url, con guía prompt opcional y control seed.

¿Qué campos son obligatorios?

Tanto image_url como audio_url son necesarios. prompt y seed son controles opcionales.

¿Qué debo proporcionar en `image_url`?

Proporcione una URL de acceso directo para que una imagen de retrato se utilice como fuente visual.

¿Cuál es el límite de duración del audio?

El audio suministrado a través de audio_url debe ser inferior a 35 segundos.

¿Qué idiomas puedo usar en `prompt`?

prompt admite chino, inglés, japonés, coreano, español de México y indonesio.

¿Cómo funciona `seed`?

seed es un control entero cuyo valor predeterminado es -1.

¿Qué debo verificar antes de enviar los archivos fuente?

Confirme que image_url y audio_url sean accesibles directamente y que el audio dure menos de 35 segundos.

¿Qué controles de salida están expuestos?

El esquema de entrada no expone los campos de resolución de salida, relación de aspecto, velocidad de cuadros o formato de salida.

¿Cuál es la lista de verificación de solicitud final?

Proporcione image_url y audio_url, mantenga el audio por debajo de 35 segundos, use un idioma admitido si agrega prompt y revise seed antes de enviarlo.

Síguenos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Soporte
  • Discord
  • Correo electrónico
  • Estado del sistema
  • afiliado
Modelos de Video
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • Ver todos los modelos →
Modelos de Imagen
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • Ver todos los modelos →
Legal
  • Términos de servicio
  • Política de privacidad
  • Política de cookies
RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.

Omnihuman 1.5 ejemplos

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...