Создавайте видео из фотографий с несколькими ключевыми кадрами с дополнительным звуком.
Это модель генерации 4K-видео по изображению семейства O3 от Kuaishou, настроенная на финальный рендер и сохранение главного объекта или персонажа исходного кадра на протяжении всей сцены. Передайте начальное изображение и описание, чтобы получить 4K-ролик длительностью от 3 до 15 секунд с физически достоверным движением и необязательным звуком.
Модель подходит для превращения конкретной фотографии, продуктового кадра или ключевого кадра в 4K-видео вещательного качества — без съемки, ручного ротоскопирования и собственных GPU.
| Параметр | Обязательный | Тип | По умолчанию | Диапазон / Варианты | Описание |
|---|---|---|---|---|---|
| image* | Да (*) | string (URL) | — | Публичный URL | Первый кадр, задающий внешний вид ролика. |
| prompt* | Да (*) | string | — | Свободный текст | Движение, камера, освещение и атмосфера. |
| end_image | Нет | string (URL) | — | Публичный URL | Необязательный последний кадр для управления движением. |
| duration | Нет | integer | 5 | От 3 до 15 | Длительность в секундах; цена растет линейно. |
| sound | Нет | boolean | false | true / false | Создает подходящий фоновый звук. |
| shot_type | Нет | string | customize | customize, intelligent | intelligent автоматически выбирает структуру и кадрирование; customize следует промпту. |
| multi_prompt | Нет | array | — | Список сегментов | Необязательные сегменты для переходов. |
| element_list | Нет | array | — | Список элементов | Именованные визуальные элементы для сохранения согласованности. |
Посекундная ставка в RunComfy фиксирована и не зависит от звука.
| Режим | Цена за секунду |
|---|---|
| Звук включен или выключен | $0.42 |
Ориентировочная стоимость генерации
| Длительность | Стоимость |
|---|---|
| 3 с | $1.26 |
| 5 с | $2.10 |
| 10 с | $4.20 |
| 15 с | $6.30 |
Создавайте видео из фотографий с несколькими ключевыми кадрами с дополнительным звуком.
Создайте изображение по промпту и настройте LoRA, размер, формат, шаги, негативный промпт и seed.
Изменяйте исходный ролик по текстовому промпту и создавайте синхронизированный нативный звук.
Создавайте реалистичные видео из изображений с плавной анимацией и кинематографическим стилем.
Создайте видео с синхронизированным звуком из одной необходимой текстовой подсказки. Выберите `1280x720` или `720x1280` и длительность `4`, `8` или `12` секунд.
Создавайте реалистичные видео из изображений быстро и легко с Hailuo 2.3.
Это модель семейства O3 для генерации видео по одному изображению Kuaishou для 4K-роликов длительностью от 3 до 15 секунд с физически достоверным движением. Она подходит для анимации фотографий, премиальных продуктовых роликов и вертикальной рекламы, где важны детализация 4K и точное сохранение главного объекта или персонажа.
Модель ориентирована на максимальное разрешение и детализацию финального рендера в линейке O3 image-to-video. Pro создает HD-результат дешевле за секунду, Standard еще дешевле и рассчитан на черновики и массовые итерации, согласно открытым данным.
Да. Добавьте end_image к начальному кадру, чтобы закрепить траекторию движения и точно задать финальную точку. Начальное и конечное изображения вместе заметно улучшают направление движения и связность истории.
Да. Переключатель sound синтезирует подходящий фоновый звук за одну генерацию. По умолчанию он выключен, цена не меняется; включение особенно полезно для сцен с огнем, водой и насыщенной атмосферой.
Длительность задается от 3 до 15 секунд с шагом в одну секунду, по умолчанию — 5 секунд. Лучше сначала проверить движение на коротком ролике, прежде чем запускать длинный финальный рендер. Актуальные ограничения смотрите в панели RunComfy.
Модель переносит композицию, черты персонажа и стиль начального кадра во все последующие кадры — главное преимущество image-to-video по сравнению с генерацией только по тексту. Четкое, хорошо скомпонованное исходное изображение и необязательный конечный кадр дают максимальную согласованность.
image и prompt обязательны; end_image, duration, sound, shot_type, multi_prompt и element_list необязательны. URL должны быть публичными. Ограничения могут зависеть от режима или провайдера, поэтому проверяйте панель RunComfy.
Да. Создайте прототип в интерфейсе RunComfy, затем вызывайте ту же модель из бэкенда через HTTP API с теми же параметрами, без самостоятельного хостинга, настройки GPU и масштабирования.
Фиксированная цена составляет $0.42 за секунду видео независимо от звука. Ролик на 5 секунд стоит около $2.10, на 15 секунд — около $6.30. Сумма списывается с баланса USD/кредитов RunComfy; новым пользователям обычно доступна пробная сумма.
RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.





