logo
RunComfy
  • ComfyUI
  • ТренерНовое
  • Модели
  • API
  • Цены
discord logo
МОДЕЛИ
Обзор
Все модели
БИБЛИОТЕКА
Генерации
API МОДЕЛЕЙ
Документация API
API-ключи
АККАУНТ
Использование

Kling Avatar V2: видео-аватары с аудиосопровождением | RunComfy

kling/ai-avatar/v2/standard

Анимируйте один портрет с помощью звуковой дорожки с дополнительным промптом для управления движением и манерой речи.

URL портретного изображения, используемого для создания аватара.
0:00
0:00
URL-адрес аудиофайла, который управляет аватаром.
Дополнительное руководство по создаваемому видео, до 2500 символов.
Idle
The rate is $0.055 per second.

Введение в Kling Avatar V2

Kling Avatar V2 — это модель преобразования изображения в видео на основе звука, предназначенная для создания говорящего аватара из одного портрета. На этой странице RunComfy вы предоставляете один URL-адрес портрета и один URL-адрес аудио, а затем при необходимости добавляете промпт длиной до 2500 символов для управления движением или манерой речи. В интерфейсе нет отдельных элементов управления продолжительностью, соотношением сторон или разрешением. Вы можете протестировать модель в браузере или использовать ее HTTP API, не управляя инфраструктурой модели самостоятельно.

Kling Avatar V2 обзор#


Kling Avatar V2 создает видео говорящего аватара из двух необходимых мультимедийных входов: одного портрета и одной звуковой дорожки. Портрет определяет человека, показанного в видео, а звук управляет устной речью. Дополнительный промпт может содержать краткие инструкции по выражению лица, движению головы или манере речи.


Этот интерфейс RunComfy предоставляет только image, audio и prompt. Он не предоставляет отдельных элементов управления продолжительностью видео, соотношением сторон или разрешением.


Входные параметры#


ПараметрТипПо умолчанию/диапазонОписание
imagestring (image_uri)ОбязательноURL-адрес портрета, использованного для создания аватара.
audiostring (audio_uri)ОбязательноURL-адрес звуковой дорожки, которая управляет аватаром.
promptstringНеобязательно; по умолчанию: пусто; не более 2500 символовКраткие указания по движению, выражению лица и манере речи.

Подготовка входных данных#


  • Используйте четкий портрет, на котором лицо видно и не сильно закрыто.
  • Предоставляйте стабильные URL-адреса мультимедиа, которые остаются доступными во время обработки запроса.
  • Чистая запись речи помогает аудиоуправляемому аватару точнее воспроизводить подачу.
  • Держите дополнительный prompt в фокусе. Описывайте только то поведение, на которое вы хотите повлиять, например, спокойную речь или легкое движение головой.
  • Продолжительность, кадрирование и выходное разрешение не являются полями для выбора на этой странице.

Рабочий процесс браузера и API#


Начните с интерфейса модели RunComfy, чтобы вместе проверить портрет, звук и дополнительный промпт. Для интеграции приложений отправьте те же три поля через API Kling Avatar V2.


Перед производственным использованием ознакомьтесь с текущим поставщиком и условиями RunComfy и убедитесь, что у вас есть необходимые права на портрет, аудио, промпт и полученное видео.


Примеры применения#


  • Ролики с ведущими и спикерами
  • Обучающие и вводные видеоролики
  • Локализованные озвученные версии аватара.
  • Короткие выступления персонажей, основанные на записанной речи.

Для другого уровня обслуживания см. модель Kling AI Avatar V2 Pro.


Стоимость#


$0.055 за секунду.


Похожие модели

veo-3-1/fast/extend-video

Продлите исходное видео на 7 секунд в 720p с управлением через промпт и дополнительной генерацией аудио.

seedance-2.5/image-to-video/720p

Seedance 2.5: анимация неподвижного изображения в кинематографическое видео с искусственным интеллектом.

wan-2-6/text-to-video

Создайте 5-, 10- или 15-секундное видео из текстовой подсказки с дополнительным исходным звуком и элементами управления размером, структурой кадра, отрицательной подсказкой, начальным числом, расширением подсказки и сгенерированным звуком.

ltx-2.5/image-to-video/fast

LTX 2.5: анимация фотографий в видео 4K с синхронизированным звуком.

pixverse/v5.5/transition

Создайте переходное видео между обязательными начальным и конечным изображениями с настройками промпта, соотношения сторон, разрешения, длительности, стиля, аудио и оптимизации.

minimax-h3/text-to-video

MiniMax H3: преобразование текста в видео 768p/2K с собственным стереозвуком

Часто задаваемые вопросы

Могу ли я использовать результаты Kling Avatar V2 для коммерческих проектов?

Коммерческое использование зависит от текущего поставщика и условий RunComfy, а также прав, закрепленных за вашим портретом, аудио, промптом и выводом. Доступ через RunComfy не заменяет эти условия и не предоставляет прав на материалы третьих лиц. Прежде чем публиковать или монетизировать результат, ознакомьтесь с применимыми условиями.

Какие ограничения на ввод данных установлены на этой странице Kling Avatar V2?

Для страницы требуется один URL-адрес image и один URL-адрес audio. prompt является необязательным и принимает до 2500 символов. На этой странице нет отдельных входных данных для продолжительности, соотношения сторон, разрешения или нескольких референсных изображений.

Как разработчик может перейти от тестирования браузера к использованию API?

Сначала проверьте необходимые значения image и audio, а также любые необязательные prompt в интерфейсе модели RunComfy. Затем отправьте те же поля через HTTP API модели. Сохраняйте URL-адреса мультимедиа доступными в течение всего периода обработки и обрабатывайте возвращаемое состояние задания и результат в вашем приложении.

Какова основная цель Kling Avatar V2?

Эта страница предназначена для рабочего процесса говорящего аватара, управляемого звуком: один портрет определяет видимого человека, а одна звуковая дорожка управляет речью. Дополнительный промпт задаёт краткие указания по поведению. Это не интерфейс для редактирования нескольких изображений или текстовый видеоинтерфейс.

Гарантирована ли бесплатная пробная версия для Kling Avatar V2?

На этой странице не определяется гарантированное бесплатное пробное использование. Доступность кредита, цены и право на участие в учетной записи могут измениться, поэтому проверьте текущую информацию, отображаемую в вашей учетной записи RunComfy, прежде чем начинать производственный цикл.

Какие форматы изображений и аудиофайлов я могу использовать?

Схема принимает image_uri для image и audio_uri для audio, но в ней не указана точная таблица совместимости для каждого расширения. Используйте форматы, принятые текущим интерфейсом, и предоставляйте URL-адреса с прямым доступом. Если файл отклонен, преобразуйте его в распространённый веб-формат изображения или аудиоформат и повторите попытку.

Где я могу получить помощь по Kling Avatar V2 на RunComfy?

По вопросам запросов, кредитов или интеграции API обращайтесь к RunComfy по адресу hi@runcomfy.com. Укажите соответствующий идентификатор задания и краткое описание проблемы, но не отправляйте личные медиафайлы или учетные данные по электронной почте.

Подписывайтесь на нас
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Поддержка
  • Discord
  • Email
  • Статус системы
  • партнёр
Модели видео
  • PixVerse V6
  • PixVerse V6 Text To Video
  • PixVerse C1
  • Wan 2.6 Flash
  • Wan 2.5
  • Wan 3.0
  • Посмотреть все модели →
Модели изображений
  • Qwen Image 2.1
  • Qwen Image 2.1 T2I
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Nano Banana Pro
  • Flux 2 Pro
  • Посмотреть все модели →
Юридическая информация
  • Условия обслуживания
  • Политика конфиденциальности
  • Политика в отношении файлов cookie
RunComfy
Авторское право 2026 RunComfy. Все права защищены.

RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.

Примеры Kling Avatar V2 в действии

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...