Создайте видео 16:9 по исходному изображению и промпту, выбрав длительность, разрешение, частоту кадров и генерацию звука.
Эта модель принимает одно изображение и текстовую инструкцию, а затем превращает статичный кадр в короткий кинематографичный ролик со встроенным звуком. Она находится в семействе Google Gemini Omni Flash, которое также охватывает преобразование текста в видео, редактирование видео и видео по референсам; на этой странице RunComfy выполняется задача преобразования изображения в видео.
Поскольку модель рассуждает о том, как ведет себя физический мир, движение остается последовательным с первого кадра, а не смещается или деформируется по ходу действия кадра.
Входные данные соответствуют схеме RunComfy OpenAPI Input для задачи преобразования изображения в видео.
| Параметр | Обязательный | Тип | По умолчанию | Диапазон / Варианты | Описание |
|---|---|---|---|---|---|
| prompt* | Да (*) | string | — | текстовое описание | Описывает, как должно двигаться или изменяться входное изображение |
| image_url* | Да (*) | string (URI изображения) | — | jpg, jpeg, png, webp | Неподвижное изображение для анимации |
| aspect_ratio | Нет | string | 16:9 | 16:9, 9:16 | Соотношение сторон сгенерированного видео |
| duration | Нет | integer | 8 | 3–10 (секунд) | Длина сгенерированного видео в целых секундах |
Оплата производится в зависимости от длины созданного клипа:
Создайте видео 16:9 по исходному изображению и промпту, выбрав длительность, разрешение, частоту кадров и генерацию звука.
Создайте в Pikaframes плавную анимацию между начальным и конечным изображениями.
Создавайте короткие видео по тексту, выбирая длительность, формат кадра и генерацию аудио.
Создавайте реалистичную анимацию из 2D-иллюстраций с точной мимикой
Анимируйте изображение первого кадра в видео 768p или 2K длительностью до 15 секунд.
Seedance 2.5 4K Image to Video: анимировать кадры в движении 4K.
Gemini Omni Flash Image to Video берет одно неподвижное изображение и текстовый промпт, а затем анимирует изображение в короткий клип с синхронизированным звуком. Он обеспечивает естественное движение объекта и сцены, поэтому вы можете превратить один кадр в движущийся кадр со звуком без отдельной анимации или звукового этапа.
Он хорошо подходит для превращения фотографий в короткие видеоролики для социальных сетей, тестирования движений и темпа камеры на основе референсного изображения, а также для быстрого создания прототипов аудиовизуальных концепций. Создатели, маркетологи, а также команды, работающие над фильмами или играми, часто используют Gemini Omni Flash Image to Video, чтобы изучить движение и атмосферу, прежде чем переходить к полному этапу производства.
Модель генерирует звук синхронно с анимированным изображением, включая речь, окружающие эффекты и музыку, где это необходимо. Вы можете управлять этим в промпте Gemini Omni Flash Image to Video, указав желаемый тон диалога или фоновый звук, или запросив отсутствие диалога, когда вам нужен тихий клип.
Начиная с загруженного изображения, вы получаете более жесткий контроль над вступительной композицией и идентичностью объекта, чем текстовый промпт. При использовании Gemini Omni Flash Image to Video кадр закрепляет вид, а промпт указывает, как движется сцена, что полезно, когда вы уже имеете в виду конкретный кадр.
Gemini Omni Flash Image to Video поддерживает пейзажное кадрирование 16:9 и портретное кадрирование 9:16 с длиной клипа от 3 до 10 целых секунд. Проверьте текущую панель параметров RunComfy, чтобы узнать точные параметры, поскольку доступные настройки могут со временем меняться.
Вы предоставляете одно входное изображение плюс текстовый промпт, описывающую движение; Поддерживаемые форматы изображений включают jpg, jpeg, png и webp. Для любых ограничений, не перечисленных на панели, просмотрите поля параметров RunComfy, поскольку некоторые ограничения могут различаться в зависимости от настроек провайдера.
Да. Вы можете создать прототип Gemini Omni Flash Image to Video в интерфейсе модели RunComfy, а затем вызвать ту же модель через RunComfy HTTP API с идентичными параметрами для автоматизации и производства. Это позволяет перейти от тестирования к интеграции без размещения или масштабирования модели самостоятельно.
Использование Gemini Omni Flash Image to Video оплачивается по длительности сгенерированного видео: $0.14 за секунду. Сумма списывается с баланса в USD или в кредитах аккаунта RunComfy. Новым пользователям обычно предоставляются пробные кредиты; актуальная цена указана в разделе генерации на этой странице.
RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.





