Cree un vídeo de avatar a partir de una imagen y un archivo de audio necesarios, con un prompt de texto opcional como guía de generación.
Kling 2.6 Pro utiliza una imagen de referencia y un prompt de texto para crear un video corto. El prompt describe la acción, el comportamiento de la cámara, la atmósfera y cualquier discurso o sonido deseado. Puede elegir una duración de 5 o 10 segundos, enumerar cualidades no deseadas en negative_prompt y activar o desactivar el audio nativo con generate_audio.
Esta página no expone entradas de relación de aspecto o resolución. No agregue esos campos a una carga útil de API para esta página de modelo.
| Parámetro | Tipo | Predeterminado/intervalo | Descripción |
|---|---|---|---|
| prompt | string | Obligatorio; prompt de ejemplo predefinido | Describe el tema, la acción, la cámara, la atmósfera y el habla o sonido opcional. |
| image_url | string (image_uri) | Obligatorio; URL de imagen de ejemplo predefinida | URL de la imagen de referencia única utilizada para crear el vídeo. |
| duration | integer | Opcional; predeterminado: 5; opciones: 5, 10 | Duración del vídeo generado en segundos. |
| negative_prompt | string | Opcional; predeterminado: "blur, distort, and low quality" | Cualidades o artefactos que el modelo debe evitar. |
| generate_audio | boolean | Opcional; predeterminado: true | Activa o desactiva la generación de audio nativo. |
negative_prompt para cualidades específicas no deseadas en lugar de repetir el prompt principal.duration explícitamente: los valores aceptados son 5 y 10.generate_audio en false cuando desee un clip silencioso para un diseño de sonido posterior.generate_audio habilitado, se admite la salida de voz en chino e inglés. Otros idiomas se traducen automáticamente al inglés.aspect_ratio o resolution en esta página.Utilice los mismos cinco campos que se muestran arriba cuando pase de las pruebas del navegador a la Kling 2.6 Pro API de imagen a video. Valide duration antes del envío y mantenga image_url accesible mientras se ejecuta el trabajo.
La audioguía Kling 2.6 del proveedor contiene orientación adicional sobre el producto. El uso comercial sigue sujeto a los términos actuales del proveedor y de la plataforma.
Si desea generar sin una imagen de referencia, utilice Kling 2.6 Pro Texto a vídeo.
Cree un vídeo de avatar a partir de una imagen y un archivo de audio necesarios, con un prompt de texto opcional como guía de generación.
Genera vídeos cinematográficos nativos en 4K a partir de texto, con diálogo sincronizado y personajes coherentes.
Crea un vídeo con Seedance 1.0 desde un prompt y elige resolución, relación de aspecto y duración.
Cambie el estilo de un vídeo existente con instrucciones de texto conservando el movimiento original y la composición general.
MiniMax H3 Max Reference to video: referencias multimodales a clips 480p/768p
Anima una imagen a partir de una pista de audio en modo de habla, canto o actuación.
El uso comercial depende de los términos actuales de Kuaishou, RunComfy y del canal de acceso, junto con sus derechos sobre la imagen de entrada, el prompt, el contenido de audio y la salida. El acceso RunComfy no reemplaza esos términos ni otorga derechos de distribución ilimitados. Revise los términos aplicables antes de publicar o monetizar un resultado.
Los campos obligatorios son prompt y image_url. duration acepta solo 5 o 10 segundos y el valor predeterminado es 5. negative_prompt es opcional y generate_audio es un valor booleano cuyo valor predeterminado es true. Esta página no tiene entradas aspect_ratio o resolution.
Primero ajuste el prompt, la imagen de referencia, la duración, el prompt negativo y la configuración de audio en la interfaz del modelo RunComfy. Luego envíe esos mismos campos a través de la API del modelo, valide que duration sea 5 o 10, mantenga image_url accesible y maneje el estado del trabajo y los resultados en su solicitud.
Compare los modelos con la misma imagen de origen y el mismo prompt, luego revise la coherencia del tema, el movimiento, la fidelidad al prompt y, cuando esté habilitado, la relevancia y sincronización del audio. La distinción práctica de esta página es su interruptor de audio nativo opcional; no expone resultados de referencia que demuestren una ventaja universal en calidad o velocidad.
Sí. Configure generate_audio en false para un video silencioso, o déjelo en el valor predeterminado true para solicitar audio nativo. Cuando está habilitado, se admite la salida de voz en chino e inglés; otros idiomas se traducen automáticamente al inglés.
Esta página no garantiza un tiempo de finalización fijo ni un nivel de rendimiento. El procesamiento puede variar según la duración, la generación de audio, la carga del proveedor y los límites de la cuenta. Mida trabajos representativos de 5 y 10 segundos en su propio flujo de trabajo y diseñe la integración para manejar estados asincrónicos y fallas.
En esta página no se indica ninguna concesión de derechos sin restricciones. Usted sigue siendo responsable del proveedor actual y de los términos de RunComfy y de los derechos sobre la imagen de referencia, el prompt, el audio generado y el video resultante.
No puede seleccionar ninguna configuración en esta página de imagen a video porque su esquema no tiene ningún campo aspect_ratio o resolution. Prepare la imagen de referencia con el encuadre previsto y evalúe el resultado obtenido antes de adoptarlo en un diseño de producción.
Sí, la página proporciona una API HTTP para usar las mismas entradas que la interfaz del navegador. La preparación para la producción aún depende de sus propias pruebas, manejo de errores, cuotas, controles de costos, revisión de contenido y cumplimiento de los términos aplicables.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.










