Создавайте нативные кинематографичные видео в 4K по тексту с синхронными диалогами и стабильными персонажами.
Эта модель принимает одно изображение и текстовую инструкцию, а затем превращает статичный кадр в короткий кинематографичный ролик со встроенным звуком. Она находится в семействе Google Gemini Omni Flash, которое также охватывает преобразование текста в видео, редактирование видео и видео по референсам; на этой странице RunComfy выполняется задача преобразования изображения в видео.
Поскольку модель рассуждает о том, как ведет себя физический мир, движение остается последовательным с первого кадра, а не смещается или деформируется по ходу действия кадра.
Входные данные соответствуют схеме RunComfy OpenAPI Input для задачи преобразования изображения в видео.
| Параметр | Обязательный | Тип | По умолчанию | Диапазон / Варианты | Описание |
|---|---|---|---|---|---|
| prompt* | Да (*) | string | — | текстовое описание | Описывает, как должно двигаться или изменяться входное изображение |
| image_url* | Да (*) | string (URI изображения) | — | jpg, jpeg, png, webp | Неподвижное изображение для анимации |
| aspect_ratio | Нет | string | 16:9 | 16:9, 9:16 | Соотношение сторон сгенерированного видео |
| duration | Нет | integer | 8 | 3–10 (секунд) | Длина сгенерированного видео в целых секундах |
Оплата производится в зависимости от длины созданного клипа:
Создавайте нативные кинематографичные видео в 4K по тексту с синхронными диалогами и стабильными персонажами.
Создавайте кинематографичные видео из изображений с помощью Veo 3.1 Fast — быстро и просто.
Создайте видео в Seedance 1.0 по промпту и выберите разрешение, соотношение сторон и длительность.
Создайте новый кадр по референсному видео и управляйте результатом с помощью промпта, элементов, изображений, соотношения сторон, длительности и исходного звука.
Анимируйте изображение эталонного персонажа с помощью движения из управляющее видео, используя положительные и отрицательные подсказки, а также настраиваемые настройки генерации.
Превращайте статичные изображения в кинематографические ролики с нативным разрешением 4K, управлением по начальному и конечному кадрам и синхронизированным звуком.
Gemini Omni Flash Image to Video берет одно неподвижное изображение и текстовый промпт, а затем анимирует изображение в короткий клип с синхронизированным звуком. Он обеспечивает естественное движение объекта и сцены, поэтому вы можете превратить один кадр в движущийся кадр со звуком без отдельной анимации или звукового этапа.
Он хорошо подходит для превращения фотографий в короткие видеоролики для социальных сетей, тестирования движений и темпа камеры на основе референсного изображения, а также для быстрого создания прототипов аудиовизуальных концепций. Создатели, маркетологи, а также команды, работающие над фильмами или играми, часто используют Gemini Omni Flash Image to Video, чтобы изучить движение и атмосферу, прежде чем переходить к полному этапу производства.
Модель генерирует звук синхронно с анимированным изображением, включая речь, окружающие эффекты и музыку, где это необходимо. Вы можете управлять этим в промпте Gemini Omni Flash Image to Video, указав желаемый тон диалога или фоновый звук, или запросив отсутствие диалога, когда вам нужен тихий клип.
Начиная с загруженного изображения, вы получаете более жесткий контроль над вступительной композицией и идентичностью объекта, чем текстовый промпт. При использовании Gemini Omni Flash Image to Video кадр закрепляет вид, а промпт указывает, как движется сцена, что полезно, когда вы уже имеете в виду конкретный кадр.
Gemini Omni Flash Image to Video поддерживает пейзажное кадрирование 16:9 и портретное кадрирование 9:16 с длиной клипа от 3 до 10 целых секунд. Проверьте текущую панель параметров RunComfy, чтобы узнать точные параметры, поскольку доступные настройки могут со временем меняться.
Вы предоставляете одно входное изображение плюс текстовый промпт, описывающую движение; Поддерживаемые форматы изображений включают jpg, jpeg, png и webp. Для любых ограничений, не перечисленных на панели, просмотрите поля параметров RunComfy, поскольку некоторые ограничения могут различаться в зависимости от настроек провайдера.
Да. Вы можете создать прототип Gemini Omni Flash Image to Video в интерфейсе модели RunComfy, а затем вызвать ту же модель через RunComfy HTTP API с идентичными параметрами для автоматизации и производства. Это позволяет перейти от тестирования к интеграции без размещения или масштабирования модели самостоятельно.
Использование Gemini Omni Flash Image to Video оплачивается по длительности сгенерированного видео: $0.14 за секунду. Сумма списывается с баланса в USD или в кредитах аккаунта RunComfy. Новым пользователям обычно предоставляются пробные кредиты; актуальная цена указана в разделе генерации на этой странице.
RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.





