Transforma referencias visuales o de audio en clips HD con control preciso del movimiento.
Omnihuman 1.5 utiliza una imagen de retrato requerida y una pista de audio requerida para generar un video. Los controles expuestos se limitan a las dos URL de origen, una guía de texto opcional y una semilla.
image_url: obligatorio. Proporcione la URL directamente accesible de una imagen de retrato.audio_url: obligatorio. Proporcione la URL directamente accesible del audio que controla el vídeo; debe ser inferior a 35 segundos.prompt — Texto de orientación opcional. Los idiomas admitidos son chino, inglés, japonés, coreano, español de México y indonesio.seed — Semilla entera para generación. El valor predeterminado es -1.image_url.audio_url y confirme que la pista dure menos de 35 segundos.prompt usando uno de los seis idiomas admitidos.seed cuando necesite un control de semillas explícito y luego envíe la solicitud.El esquema de entrada no expone la resolución de salida, la relación de aspecto, la velocidad de fotogramas ni los controles de formato de salida.
Transforma referencias visuales o de audio en clips HD con control preciso del movimiento.
Anima una imagen del primer fotograma a un vídeo de 768p o 2K durante hasta 15 segundos
Crea un vídeo desde un prompt y controla LoRA, resolución, relación de aspecto, fotogramas, FPS, pasos y seed.
Elimina fondos con la variante Fast y configura códec, refinado de bordes y tipo de sujeto.
Genera canciones de hasta 4 minutos con voces y letras a partir de etiquetas de estilo.
Da un nuevo estilo a un video existente con Tencent Hunyuan Video.
Genera un vídeo a partir de la URL vertical requerida en image_url y la URL de audio requerida en audio_url, con guía prompt opcional y control seed.
Tanto image_url como audio_url son necesarios. prompt y seed son controles opcionales.
Proporcione una URL de acceso directo para que una imagen de retrato se utilice como fuente visual.
El audio suministrado a través de audio_url debe ser inferior a 35 segundos.
prompt admite chino, inglés, japonés, coreano, español de México y indonesio.
seed es un control entero cuyo valor predeterminado es -1.
Confirme que image_url y audio_url sean accesibles directamente y que el audio dure menos de 35 segundos.
El esquema de entrada no expone los campos de resolución de salida, relación de aspecto, velocidad de cuadros o formato de salida.
Proporcione image_url y audio_url, mantenga el audio por debajo de 35 segundos, use un idioma admitido si agrega prompt y revise seed antes de enviarlo.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.




