logo
RunComfy
  • ComfyUI
  • EntrenadorNuevo
  • Modelos
  • API
  • Precios
discord logo
MODELOS
Explorar
Todos los modelos
BIBLIOTECA
Generaciones
APIS DE MODELOS
Documentación de la API
Claves API
CUENTA
Uso

Kling Avatar V2: Vídeos de avatar parlantes con audio | RunComfy

kling/ai-avatar/v2/standard

Anime un retrato a partir de una pista de audio, con un prompt opcional para guía de movimiento y forma de hablar.

URL de la imagen del retrato utilizada para crear el avatar.
0:00
0:00
URL del archivo de audio que impulsa el avatar.
Guía opcional para el vídeo generado, hasta 2.500 caracteres.
Idle
The rate is $0.0562 per second.

Introducción a Kling Avatar V2

Kling Avatar V2 es un modelo de imagen a video basado en audio para crear un avatar parlante a partir de un solo retrato. En esta página RunComfy, usted proporciona una URL del retrato y una URL de audio y luego, opcionalmente, agrega un prompt de hasta 2500 caracteres para guiar el movimiento o la forma de hablar. La interfaz no expone controles separados de duración, relación de aspecto o resolución. Puede probar el modelo en el navegador o utilizar su API HTTP sin administrar usted mismo la infraestructura del modelo.

Kling Avatar V2 descripción general#


Kling Avatar V2 crea un video de avatar parlante a partir de dos entradas multimedia requeridas: un retrato y una pista de audio. El retrato establece a la persona que se muestra en el vídeo, mientras que el audio impulsa la interpretación hablada. Un prompt opcional puede agregar orientación concisa sobre la expresión, el movimiento de la cabeza o la forma de hablar.


Esta interfaz RunComfy expone solo image, audio y prompt. No proporciona controles separados para la duración, la relación de aspecto o la resolución del video.


Parámetros de entrada#


ParámetroTipoPredeterminado/intervaloDescripción
imagestring (image_uri)ObligatorioURL del retrato utilizado para crear el avatar.
audiostring (audio_uri)ObligatorioURL de la pista de audio que impulsa el avatar.
promptstringOpcional; predeterminado: vacío; máximo 2500 caracteresBreve guía para el movimiento, la expresión o la forma de hablar.

Preparando las entradas#


  • Utilice un retrato claro en el que el rostro sea visible y no muy cubierto.
  • Proporcionar URL de medios estables que permanezcan accesibles mientras se procesa la solicitud.
  • Un audio de voz más limpio generalmente facilita que un flujo de trabajo de avatar basado en audio siga la actuación.
  • Mantenga enfocado el prompt opcional. Describe sólo el comportamiento en el que deseas influir, como una expresión tranquila o un movimiento sutil de la cabeza.
  • La duración, el encuadre y la resolución de salida no son campos seleccionables en esta página.

Flujo de trabajo del navegador y API#


Comience en la interfaz del modelo RunComfy para verificar el retrato, el audio y el prompt opcional juntos. Para la integración de aplicaciones, envíe los mismos tres campos a través del Kling Avatar V2 endpoint de la API.


Antes del uso en producción, revise el proveedor actual y los términos de RunComfy, y asegúrese de tener los derechos necesarios sobre el retrato, el audio, el prompt y el video resultante.


Aplicaciones útiles#


  • Clips de presentador y portavoz.
  • Vídeos de formación e incorporación.
  • Versiones de voz en off localizadas de un avatar
  • Actuaciones breves de personajes impulsadas por discursos grabados.

Para conocer un nivel de servicio diferente, consulte el modelo Kling AI Avatar V2 Pro.

Modelos relacionados

gemini-omni-flash/image-to-video

Anima una imagen fija y conviértela en un vídeo corto con audio sincronizado.

wan-2-2/first-last-frame

Convierte imágenes en videos fluidos con precisión y transiciones naturales

kling-video-o3/standard/image-to-video

Clips Image-to-Video de 3 a 15 segundos por $0.084 por segundo.

ai-avatar/v2/pro

Cree un vídeo de avatar a partir de una imagen y un archivo de audio necesarios, con un prompt de texto opcional como guía de generación.

seedance-2.0/fast

Genera clips cinematográficos con mayor rapidez mediante referencias multimodales, sincronización labial y control de cámara.

pika-2-2/text-to-video

Crea videos de alta calidad a partir de prompts de texto con Pika 2.2.

Preguntas Frecuentes

¿Puedo utilizar resultados Kling Avatar V2 para proyectos comerciales?

El uso comercial depende del proveedor actual y de los términos RunComfy, así como de los derechos asociados a su retrato, audio, prompt y salida. El acceso a través de RunComfy no reemplaza esos términos ni otorga derechos sobre material de terceros. Revise los términos aplicables antes de publicar o monetizar un resultado.

¿Qué límites de entrada expone esta página Kling Avatar V2?

La página requiere una URL image y una URL audio. prompt es opcional y acepta hasta 2500 caracteres. No hay entradas separadas para duración, relación de aspecto, resolución o múltiples imágenes de referencia en esta página.

¿Cómo puede un desarrollador pasar de las pruebas de navegador al uso de API?

Primero pruebe los valores image y audio requeridos, además de cualquier prompt opcional, en la interfaz del modelo RunComfy. Luego envíe los mismos campos a través de la API HTTP del modelo. Mantenga las URL de los medios accesibles durante todo el período de procesamiento y maneje el estado del trabajo devuelto y el resultado en su aplicación.

¿Cuál es el objetivo principal de Kling Avatar V2?

Esta página está diseñada para un flujo de trabajo de avatar parlante basado en audio: un retrato define a la persona visible y una pista de audio impulsa la actuación. El prompt opcional agrega una guía de comportamiento ligera. No es una interfaz de edición de múltiples imágenes o de video de solo texto.

¿Está garantizada una prueba gratuita para Kling Avatar V2?

Esta página no define una cupo de prueba gratuita garantizada. La disponibilidad de crédito, los precios y la elegibilidad de la cuenta pueden cambiar, así que verifique la información actual que se muestra en su cuenta RunComfy antes de comenzar una ejecución de producción.

¿Qué formatos de archivos de imagen y audio puedo utilizar?

El esquema acepta un image_uri para image y un audio_uri para audio, pero no incluye una tabla definitiva de compatibilidad extensión por extensión. Utilice formatos aceptados por la interfaz actual y proporcione URL directamente accesibles. Si se rechaza un archivo, conviértalo a un formato de audio o imagen web común y vuelva a intentarlo.

¿Dónde puedo obtener ayuda con Kling Avatar V2 en RunComfy?

Si tiene preguntas sobre solicitudes, créditos o integración de API, comuníquese con RunComfy en hi@runcomfy.com. Incluya el identificador del trabajo relevante y una descripción concisa del problema, pero no envíe medios privados ni credenciales por correo electrónico.

Síguenos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Soporte
  • Discord
  • Correo electrónico
  • Estado del sistema
  • afiliado
Modelos de Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos los modelos →
Modelos de Imagen
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos los modelos →
Legal
  • Términos de servicio
  • Política de privacidad
  • Política de cookies
RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.

Ejemplos de Kling Avatar V2 en acción

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...