logo
RunComfy
  • ComfyUI
  • ТренерНовое
  • Модели
  • API
  • Цены
discord logo
МОДЕЛИ
Обзор
Все модели
БИБЛИОТЕКА
Генерации
API МОДЕЛЕЙ
Документация API
API-ключи
АККАУНТ
Использование

Gemini Omni Flash Image to Video: оживляйте изображения с синхронным звуком | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video анимирует загруженное изображение и создаёт короткий ролик со встроенным синхронным звуком. Движение задаётся промптом; доступны форматы 16:9 и 9:16 и длительность 3–10 секунд.

Опишите, как должно двигаться или изменяться входное изображение. В промпте можно задать движение камеры, темп и звук, например «медленный наезд камеры», «лёгкий ветер и пение птиц» или «без диалогов». Также можно добавить негативные инструкции, например «Не показывать текст».
Входное изображение для анимации. Поддерживаемые форматы: jpg, jpeg, png, webp.
Соотношение сторон создаваемого видео.
Продолжительность создаваемого видео в секундах.
Idle
The rate is $0.14 per second of generated video.

Введение в Gemini Omni Flash Image to Video

Gemini Omni Flash Image to Video от Google оживляет одно неподвижное изображение и превращает его в ролик длительностью 3–10 секунд с синхронными движением и звуком. Понимание реального мира, заложенное в Gemini, помогает сохранять анимацию правдоподобной. Один запуск по промпту заменяет отдельную работу с анимацией, ключевыми кадрами и звуковым оформлением, поэтому модель подходит для маркетинга, кино, игр и социальных сетей. В RunComfy она доступна в браузере и через HTTP API — размещать и масштабировать модель самостоятельно не требуется.
Подходит для: роликов из статичных изображений | проверки аудиовизуальных концепций | кинематографичных сцен по референсу

Google / Gemini Omni Flash Image to Video#


Эта модель принимает одно изображение и текстовую инструкцию, а затем превращает статичный кадр в короткий кинематографичный ролик со встроенным звуком. Она находится в семействе Google Gemini Omni Flash, которое также охватывает преобразование текста в видео, редактирование видео и видео по референсам; на этой странице RunComfy выполняется задача преобразования изображения в видео.


Поскольку модель рассуждает о том, как ведет себя физический мир, движение остается последовательным с первого кадра, а не смещается или деформируется по ходу действия кадра.


Основные моменты#


  • Анимация одного изображения. Начните с одного кадра и позвольте модели определить естественное, учитывающее физику движение объекта и сцены.
  • Встроенный синхронизированный звук. Речь, окружающий звук и музыка генерируются синхронно с изображением, поэтому клип можно опубликовать без отдельного аудиопрохода.
  • Движение по промпту. Описывайте движения, темп и настроение камеры простым языком, чтобы кадр ожил.
  • Основано на реальных знаниях: результаты основаны на понимании Gemini реального мира, помогая анимированным сценам оставаться правдоподобными и соответствовать теме.
  • Гибкое кадрирование: выберите пейзаж 16:9 или портрет 9:16 длительностью от 3 до 10 секунд с шагом в одну секунду.
  • Часть линейки: линейка Gemini Omni Flash позволяет выполнять несколько видеозадач; на этой странице основное внимание уделяется превращению изображений в движение.

Параметры#


Входные данные соответствуют схеме RunComfy OpenAPI Input для задачи преобразования изображения в видео.


ПараметрОбязательныйТипПо умолчаниюДиапазон / ВариантыОписание
prompt*Да (*)string—текстовое описаниеОписывает, как должно двигаться или изменяться входное изображение
image_url*Да (*)string (URI изображения)—jpg, jpeg, png, webpНеподвижное изображение для анимации
aspect_ratioНетstring16:916:9, 9:16Соотношение сторон сгенерированного видео
durationНетinteger83–10 (секунд)Длина сгенерированного видео в целых секундах

Цены#


Оплата производится в зависимости от длины созданного клипа:


  • Видео: $0.14 в секунду созданного видео.

Похожие модели

kling-3.0/4k/text-to-video

Создавайте нативные кинематографичные видео в 4K по тексту с синхронными диалогами и стабильными персонажами.

veo-3-1/fast/image-to-video

Создавайте кинематографичные видео из изображений с помощью Veo 3.1 Fast — быстро и просто.

seedance-1.0/text-to-video

Создайте видео в Seedance 1.0 по промпту и выберите разрешение, соотношение сторон и длительность.

kling-video-o1/video-to-video/reference

Создайте новый кадр по референсному видео и управляйте результатом с помощью промпта, элементов, изображений, соотношения сторон, длительности и исходного звука.

one-to-all-animation/1.3b

Анимируйте изображение эталонного персонажа с помощью движения из управляющее видео, используя положительные и отрицательные подсказки, а также настраиваемые настройки генерации.

kling-3.0/4k/image-to-video

Превращайте статичные изображения в кинематографические ролики с нативным разрешением 4K, управлением по начальному и конечному кадрам и синхронизированным звуком.

Часто задаваемые вопросы

Что делает Gemini Omni Flash Image to Video?

Gemini Omni Flash Image to Video берет одно неподвижное изображение и текстовый промпт, а затем анимирует изображение в короткий клип с синхронизированным звуком. Он обеспечивает естественное движение объекта и сцены, поэтому вы можете превратить один кадр в движущийся кадр со звуком без отдельной анимации или звукового этапа.

Каковы наилучшие варианты использования Gemini Omni Flash Image to Video?

Он хорошо подходит для превращения фотографий в короткие видеоролики для социальных сетей, тестирования движений и темпа камеры на основе референсного изображения, а также для быстрого создания прототипов аудиовизуальных концепций. Создатели, маркетологи, а также команды, работающие над фильмами или играми, часто используют Gemini Omni Flash Image to Video, чтобы изучить движение и атмосферу, прежде чем переходить к полному этапу производства.

Как Gemini Omni Flash Image to Video обрабатывает звук?

Модель генерирует звук синхронно с анимированным изображением, включая речь, окружающие эффекты и музыку, где это необходимо. Вы можете управлять этим в промпте Gemini Omni Flash Image to Video, указав желаемый тон диалога или фоновый звук, или запросив отсутствие диалога, когда вам нужен тихий клип.

Чем Gemini Omni Flash Image to Video отличается от преобразования текста в видео?

Начиная с загруженного изображения, вы получаете более жесткий контроль над вступительной композицией и идентичностью объекта, чем текстовый промпт. При использовании Gemini Omni Flash Image to Video кадр закрепляет вид, а промпт указывает, как движется сцена, что полезно, когда вы уже имеете в виду конкретный кадр.

Какие соотношения сторон и длительность поддерживает Gemini Omni Flash Image to Video?

Gemini Omni Flash Image to Video поддерживает пейзажное кадрирование 16:9 и портретное кадрирование 9:16 с длиной клипа от 3 до 10 целых секунд. Проверьте текущую панель параметров RunComfy, чтобы узнать точные параметры, поскольку доступные настройки могут со временем меняться.

Какие ограничения ввода мне следует знать перед использованием Gemini Omni Flash Image to Video?

Вы предоставляете одно входное изображение плюс текстовый промпт, описывающую движение; Поддерживаемые форматы изображений включают jpg, jpeg, png и webp. Для любых ограничений, не перечисленных на панели, просмотрите поля параметров RunComfy, поскольку некоторые ограничения могут различаться в зависимости от настроек провайдера.

Могут ли разработчики использовать Gemini Omni Flash Image to Video через API RunComfy?

Да. Вы можете создать прототип Gemini Omni Flash Image to Video в интерфейсе модели RunComfy, а затем вызвать ту же модель через RunComfy HTTP API с идентичными параметрами для автоматизации и производства. Это позволяет перейти от тестирования к интеграции без размещения или масштабирования модели самостоятельно.

Сколько стоит генерировать с помощью Gemini Omni Flash Image to Video на RunComfy?

Использование Gemini Omni Flash Image to Video оплачивается по длительности сгенерированного видео: $0.14 за секунду. Сумма списывается с баланса в USD или в кредитах аккаунта RunComfy. Новым пользователям обычно предоставляются пробные кредиты; актуальная цена указана в разделе генерации на этой странице.

Подписывайтесь на нас
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Поддержка
  • Discord
  • Email
  • Статус системы
  • партнёр
Модели видео
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Посмотреть все модели →
Модели изображений
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Посмотреть все модели →
Юридическая информация
  • Условия обслуживания
  • Политика конфиденциальности
  • Политика в отношении файлов cookie
RunComfy
Авторское право 2026 RunComfy. Все права защищены.

RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.

Примеры Gemini Omni Flash Image to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...