Amplía una pista de audio al principio, al final o en ambos extremos manteniendo su estilo.
Kling Video O3 Pro Reference To Video es el modelo Pro guiado por referencias de la serie O3 de Kuaishou, optimizado para la calidad del render final. Crea clips nuevos mientras conserva la identidad de los personajes, el atrezo o los estilos aportados como referencia. Un vídeo opcional también puede guiar el movimiento o el estilo.
Está pensado para vídeos cinematográficos cortos con personas, productos o direcciones artísticas concretas, sin rodaje, rotoscopia manual ni alojamiento del modelo.
Amplía una pista de audio al principio, al final o en ambos extremos manteniendo su estilo.
Convierte imágenes en videos fluidos y cinematográficos con IA
Genera vídeos cinematográficos con audio sincronizado a partir de un prompt de texto.
Convierte tus ideas en videos realistas con movimiento fluido y detalle vivo.
Pesos abiertos de referencia a video a partir de señales de imagen, video y audio.
Genera voz y audio naturales a partir de texto, audio de referencia o una imagen.
Kling Video O3 Pro Reference To Video es el modelo Pro guiado por referencias de la serie O3 de Kuaishou. Genera desde un prompt un clip cinematográfico de 3 a 15 segundos mientras conserva la identidad de las personas, el atrezo o los estilos de las imágenes aportadas. Un vídeo opcional puede guiar el movimiento o el estilo. Los personajes y el aspecto se mantienen coherentes entre fotogramas con el alto nivel de detalle de la versión Pro.
Puedes aportar imágenes de personajes, atrezo o estilos artísticos, además de un vídeo opcional para transferir movimiento o estilo. Se admiten hasta 7 imágenes sin vídeo de referencia y hasta 4 con uno. En el prompt, vincula cada sujeto con la posición de su imagen, por ejemplo «La persona de la imagen 1 está junto a la persona de la imagen 2», para que el modelo sepa dónde colocar cada elemento.
Según la información disponible del proveedor, la versión Pro ofrece un nivel de calidad superior en movimiento, iluminación y estabilidad de identidad para campañas destacadas y producciones profesionales. La versión Standard, más económica, sirve para borradores e iteraciones de gran volumen. Prompt, referencias, relación de aspecto, duración, sonido y tipo de toma funcionan de forma comparable, sin rehacer el trabajo.
Equipos de cine, agencias, estudios de marca, productores de comercio electrónico y grupos de producto crean a partir de imágenes existentes spots con identidad coherente en otras escenas, ambientes o con distinto atrezo, sin repetir el rodaje. También sirve para contenido con portavoz, reels conceptuales, narrativas con varios personajes y versiones de campaña con el mismo estilo. Los desarrolladores automatizan flujos que convierten un brief y unas pocas referencias en un clip terminado.
prompt es obligatorio; las imágenes y el vídeo de referencia son opcionales, aunque recomendables. Puedes usar hasta 7 imágenes o 4 junto con un vídeo. aspect_ratio acepta 16:9, 9:16 o 1:1, duration es un entero de 3 a 15 segundos y shot_type acepta customize o intelligent. sound y keep_original_sound son booleanos; la generación de sonido solo se aplica si no hay vídeo de referencia. Consulta RunComfy para conocer las reglas actuales de resolución y formato.
Sí. Ajusta primero las referencias, el prompt, la relación de aspecto, la duración y las opciones de audio en RunComfy AI Playground. Después, la producción puede ejecutarse en tu código mediante la API de RunComfy con los mismos parámetros, sin cambiar el comportamiento del modelo.
Cuesta 0,19 $ por segundo, o 0,23 $ con sonido sintetizado. El sonido sintetizado solo está disponible cuando no se usa un vídeo de referencia, por lo que una generación con vídeo de referencia se factura a 0,19 $ por segundo, y las imágenes o el vídeo de referencia no suponen coste adicional. Así, 5 segundos cuestan unos 0,615 $ (0,745 $ con sonido sintetizado) y 15 segundos unos 1,845 $ (2,235 $ con sonido sintetizado). Los costes se descuentan del saldo de RunComfy en USD/créditos y los usuarios nuevos suelen recibir crédito de prueba.
Asigna claramente un papel a cada referencia con «Imagen 1», «Imagen 2», etc., y después describe la acción, el entorno y el movimiento de cámara. Indicaciones como «travelling lento de 50 mm», «contraluz cálido de hora dorada» o «fuentes de neón visibles» guían mejor el aspecto y el movimiento que las palabras vagas. En escenas complejas, varios segmentos de prompt separan las secuencias y mantienen transiciones limpias.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





