Превращайте неподвижные портреты в выразительные, реалистичные видеоролики с контролем и точностью.
React-1 принимает обязательные video_url и audio_url и создает на их основе видео с синхронизацией губ. Оба входа должны быть 15 секунд или короче. Вы можете задавать эмоциональную подачу с помощью emotion, выбирать область редактирования с помощью model_mode, решать, как обрабатывать несовпадающие длины входных данных с помощью lipsync_mode и регулировать выразительность с помощью temperature.
| Параметр | Требуется | По умолчанию/опции | Что он контролирует |
|---|---|---|---|
video_url | Да | пример URL видео | Публичный URL-адрес исходного видео; 15 секунд или меньше. |
audio_url | Да | пример URL аудио | Публичный URL управляющего аудио; 15 секунд или меньше. |
emotion | Нет | По умолчанию neutral | Точные значения: happy, angry, sad, neutral, disgusted, surprised. Поддерживаются только значения эмоций, состоящие из одного слова. |
model_mode | Нет | По умолчанию face | Точные значения: lips, face, head. Устанавливает область редактирования и область перемещения. |
lipsync_mode | Нет | По умолчанию bounce | Точные значения: cut_off, loop, bounce, silence, remap. Управляет обработкой, когда длительность аудио и видео различается. |
temperature | Нет | По умолчанию 0.5; 0–1 | Управляет выразительностью синхронизации губ. |
emotion и самый узкий подходящий model_mode.lipsync_mode сознательно, если входные длины различаются, а затем корректируйте temperature небольшими шагами.Превращайте неподвижные портреты в выразительные, реалистичные видеоролики с контролем и точностью.
Создавайте реалистичные AI-видео из изображений с чётким движением и высоким качеством
Кинематографическая генерация 4K-видео по референсам — $0.42 за секунду результата.
Редактируйте существующее видео по текстовой инструкции и URL исходного ролика.
HappyHorse 1.0 с нативным выводом 1080p, кинематографичным движением и согласованностью мультишотов.
Создайте видео 16:9 по исходному изображению и промпту, выбрав длительность, разрешение, частоту кадров и генерацию звука.
На этой странице документируется React-1 как рабочий процесс синхронизации губ для видео и аудио с элементами управления эмоциями, областью редактирования, обработкой несоответствий и выразительностью. Он не включает в себя контрольные данные по Lipsync-2 или Lipsync-2-Pro, поэтому заявления об относительном качестве или сохранении идентичности не могут быть подтверждены только на основе схемы.
Да. Подключите существующий клип через обязательный video_url и дорожку через обязательный audio_url. Оба должны длиться 15 секунд или меньше. Затем выберите emotion, model_mode, lipsync_mode и temperature по мере необходимости.
Схема ограничивает входы video_url и audio_url 15 секундами каждый. Он не раскрывает выходное разрешение, соотношение сторон, частоту кадров, формат вывода, настройки ControlNet или IP-адаптера, поэтому на этой странице не устанавливаются заявления о 4K, 1080p и 16:9.
Нет. Задокументированные входы video_url и audio_url должны длиться 15 секунд или меньше. Схема не описывает режим более длинной последовательности.
После проверки настроек используйте RunComfy конечную точку API и отправьте те же задокументированные поля: video_url, audio_url, emotion, model_mode, lipsync_mode и temperature. Ознакомьтесь с текущей документацией API по вопросам аутентификации, опроса статуса, ограничений и выставления счетов.
emotion принимает только happy, angry, sad, neutral, disgusted или surprised, с neutral по умолчанию. model_mode устанавливает область редактирования, а temperature регулирует выразительность между 0 и 1. Схема не документирует конкретный метод диффузии или геометрии лица.
В качестве практического руководства используйте короткий клип, в котором видно говорящее лицо и рот, и обеспечьте чистый окончательный звук. Сильная окклюзия, очень маленькие лица или противоречивые движения могут затруднить обзор, хотя в схеме не публикуются формальные пороговые значения качества для этих условий.
Эта страница начинается с существующего video_url и вождения audio_url, а затем предоставляет элементы управления синхронизацией губ. Он не предлагает полей для преобразования текста в видео или изображения в видео для создания новой сцены с нуля.
Коммерческое использование зависит от последних условий синхронизации и RunComfy, а также от прав на исходное видео и аудио. Сама схема не предоставляет универсальную коммерческую лицензию; проверьте действующую лицензию перед платным или публичным распространением.
Это означает, что вы можете выбрать одно из шести точных значений emotion и установить диапазон движения от lips, face или от head до model_mode. lipsync_mode обрабатывает несоответствия длительности, а temperature регулирует выразительность. Никакие более широкие возможности производительности не должны подразумеваться за пределами этих документированных средств контроля.
RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.





