Edite un video existente con una instrucción de texto y hasta diez imágenes de referencia opcionales, con un control para preservar el audio original.
Kling V3.0 4K Image-to-Video es el modelo premium de animación de imágenes con IA de Kuaishou que convierte una única imagen de referencia en un vídeo cinematográfico nativo 4K (3840×2160) de 3–15 segundos, con una imagen inicial obligatoria, una imagen final opcional y sonido sincronizado. Los resultados tienen calidad de máster y no necesitan reescalado: están listos para edición, etalonaje o entrega directa.
| Atributo | Valor |
|---|---|
| Resolución nativa | 3840×2160 (4K UHD) |
| Duración | 3–15 segundos |
| Relaciones de aspecto | 16:9, 9:16, 1:1 |
| Audio | Sonido sincronizado opcional |
| Control de fotogramas | Imagen inicial requerida, imagen final opcional |
| Precios | $0.42 por segundo (audio activado o desactivado) |
| Formatos de entrada | jpg, jpeg, png, bmp, webp |
Kling V3.0 4K Image-to-Video utiliza una única tarifa fija por segundo independientemente de si el audio está activado o desactivado:
| Unidad de facturación | Audio | Tarifa |
|---|---|---|
| Por segundo generado | Desactivado | $0.42 por segundo |
| Por segundo generado | Activado | $0.42 por segundo |
Un clip de 5 segundos cuesta $2.10. Un clip de 15 segundos cuesta $6.30. Habilitar el audio no agrega ningún recargo.
Edite un video existente con una instrucción de texto y hasta diez imágenes de referencia opcionales, con un control para preservar el audio original.
Anima una imagen fija y conviértela en un vídeo corto con audio sincronizado.
Edita un segmento preciso de una pista de audio sin alterar el resto.
Genere vídeo de 768p o 2K a partir de referencias de imagen, vídeo y audio
Genere un video de 5 o 10 segundos a partir de un prompt obligatorio. Elija `16:9`, `9:16` o `1:1`, agregue un prompt negativo opcional y ajuste la intensidad del prompt.
Modelo de movimiento cinematográfico para creación fluida de escenas y edición visual adaptativa.
Kling V3.0 4K Image-to-Video se renderiza directamente en 3840×2160 en una sola pasada, sin reescalado, mientras que la variante estándar ofrece como máximo 1080p. La opción 4K incorpora una imagen inicial obligatoria y una imagen final opcional para transiciones controladas entre dos fotogramas y comparte la misma secuenciación de varios prompts, anclaje de identidad mediante elements y audio sincronizado que el resto de la familia de imagen a vídeo V3.0. Elija 4K cuando el entregable deba tener calidad de máster y la imagen de origen ya contenga el detalle que vale la pena conservar.
Kling V3.0 4K Image-to-Video genera salidas nativas en 3840×2160 (UHD 4K) y admite duraciones de clip de 3 a 15 segundos. Debido a que el modelo se procesa con resolución 4K completa, se espera una latencia de generación notablemente más larga que la variante estándar 1080p durante la misma duración.
Proporcione una imagen inicial a través de start_image_url y una imagen final opcional a través de end_image_url. El modelo generará movimiento que realiza una transición suave entre los dos fotogramas, lo cual es ideal para transformaciones cinematográficas, cambios de escena, revelaciones de antes y después y continuidad entre planos. Si se omite end_image_url, el movimiento será impulsado únicamente por la imagen inicial y el prompt.
Sí. Además de la imagen inicial obligatoria y la imagen final opcional, puede adjuntar hasta tres elementos para bloquear la identidad, el vestuario o la marca en el clip. Cada elemento admite una imagen de referencia frontal, URL de imágenes de referencia adicionales y un vídeo de referencia corto opcional para guía de movimiento. Superar el número de referencias admitido puede provocar un recorte del prompt o un movimiento inconsistente.
Kling V3.0 4K Image-to-Video acepta archivos de imagen estándar (JPG, JPEG, PNG, BMP, WEBP) para los fotogramas inicial y final, además de prompts de texto opcionales, segmentos de varios prompts y recursos de referencia. Para obtener el mejor resultado 4K, utilice imágenes de origen de alta resolución que coincidan con la relación de aspecto objetivo de su clip.
Sí. Configure generate_audio en true y el modelo sintetizará sonido ambiental, diálogos o efectos directamente durante la generación de imagen a vídeo 4K, alineado con el movimiento producido. El precio es el mismo con independencia de que el audio esté activado.
Kling V3.0 4K Image-to-Video se factura a un precio fijo de $0.42 por segundo, independientemente de que el audio esté habilitado o no, lo que hace que el presupuesto sea predecible para los proyectos 4K. En comparación, el nivel estándar de imagen a vídeo se factura a $0.084 por segundo sin audio y a $0.126 por segundo con audio. La tarifa 4K refleja el mayor cálculo por fotograma necesario para renderizar de forma nativa en 3840×2160.
Después de validar el comportamiento de los prompts y parámetros en RunComfy Playground, genere una clave API desde su RunComfy Dashboard. La API refleja todas las configuraciones del Playground, incluidas las URL de imágenes inicial y final, segmentos de varios prompts, referencias de elementos, alternancia de audio, prompts negativos y escala CFG, y opera a través de endpoints REST autenticados. Asigne créditos USD para producción y gestione la descarga asíncrona de los vídeos generados a través de la cola de trabajos de RunComfy.
Kling V3.0 4K Image-to-Video combina las referencias del array elements —imágenes frontales, imágenes de referencia adicionales y vídeos de movimiento opcionales— con la imagen inicial y, si se proporciona, la imagen final para mantener la identidad, la iluminación y el color estables en todos los fotogramas. En el 4K nativo, esta coherencia es especialmente importante porque el parpadeo o la deriva se vuelven más visibles a resoluciones más altas.
Sí. Los resultados de Kling V3.0 4K Image-to-Video se pueden utilizar comercialmente siempre que su uso cumpla con los términos de licencia de Kuaishou Technology y el acuerdo de servicio de RunComfy. Para procesos profesionales, el modelo se integra con la API de RunComfy para flujos de trabajo automatizados de imagen a vídeo 4K, renderizado por lotes y entrega directa en herramientas de edición, color y acabado.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





