Мультимодальная видеомодель с нативным звуком для генерации по тексту, изображениям и референсам.
Minimax H3 Image to Video is MiniMax's H3-series model for turning one picture into moving footage. You hand it the opening frame and describe what should happen; the model resolves motion, camera behavior, and scene development, then renders at 768p or 2K.
Because the first frame is pinned by your upload, subject identity, wardrobe, palette, and framing carry through the clip. Minimax H3 Image to Video therefore fits work where the look is settled and only movement is missing.
768p for cheaper drafts or 2k when faces, packaging text, and fine texture need to survive a full-screen crop.These are the live fields for Minimax H3 Image to Video on this page.
| Parameter | Required | Type | Default | Range / Options | Description |
|---|---|---|---|---|---|
| image * | Yes (*) | string (URL) | Sample first frame | 256-5760 px per side, aspect ratio 0.4-2.5 | Opening frame that anchors subject, composition, and style. |
| prompt * | Yes (*) | string | Sample motion brief | 1-4000 characters | What should move, how the camera behaves, how the scene develops. |
| last_image | No | string (URL) | None | Same image constraints as image | Closing frame used to steer where the clip ends. |
| duration * | Yes (*) | integer | 5 | 4-15 | Clip length in whole seconds. |
| resolution * | Yes (*) | string | 768p | 768p, 2k | Output resolution tier. |
Minimax H3 Image to Video bills on resolution and the length of the finished clip:
| Resolution | Price per second | 5s | 10s | 15s |
|---|---|---|---|---|
| 768p | $0.11 | $0.55 | $1.10 | $1.65 |
| 2K | $0.16 | $0.80 | $1.60 | $2.40 |
1) Upload the opening frame — Pick an image where the subject reads clearly and the composition matches the shot you want.
2) Write the motion brief — Say what moves, how fast, and what the camera does. Minimax H3 Image to Video answers to verbs and camera language, not adjective lists.
3) Add a closing frame (optional) — Supply a last image when the ending matters, and keep it compatible with the first frame.
4) Set the length — Start at 5 seconds while tuning wording, then extend toward 15 once the motion behaves.
5) Choose the resolution — Use 768p for drafts; switch to 2k for final deliveries that need more detail.
6) Generate — Submit and review the Minimax H3 Image to Video result at full size.
7) Iterate one variable at a time — Swap the prompt, image, duration, or resolution separately so you can tell what changed the take.
When Minimax H3 Image to Video is not the right fit, these are worth a pass:
Мультимодальная видеомодель с нативным звуком для генерации по тексту, изображениям и референсам.
Создавайте видео с Wan 2.1, используя пользовательскую ссылку LoRA и подробные настройки вывода и сэмплирования.
Создайте видео по обязательному текстовому промпту с точными настройками соотношения сторон, разрешения, длительности, стиля, сида, аудио, нескольких клипов и оптимизации.
Точные движения, управление камерой и кинематографичное видео
Измените стиль существующего видео с помощью Tencent Hunyuan Video.
Превращайте статичные изображения в плавные анимированные ролики с управлением звуком.
Minimax H3 Image to Video принимает неподвижное изображение плюс записанное видео и возвращает видеоклип с разрешением 768p или 2K. Он создан для превращения иллюстраций, фотографий продуктов или визуализированного кадра в движущийся снимок без перестройки сцены в 3D-инструменте или инструменте композитинга. Загруженное изображение фиксирует начальный кадр, поэтому уже одобренный вами объект и кадр переносятся в клип.
Помимо обязательного первого кадра, Minimax H3 Image to Video принимает необязательное последнее изображение, которое определяет окончание клипа. Модель рассчитывает движение между двумя кадрами, а не дрейфует к произвольному конечному состоянию. Сохраняйте два изображения визуально совместимыми по освещению, палитре и кадрированию, иначе переход будет выглядеть вынужденным.
Выходное разрешение выбирается как «768p» или «2k», а продолжительность выбирается от 4 до 15 секунд в целых секундах. Более короткие клипы — это практичный выбор, пока вы еще тестируете быстрые формулировки с помощью Minimax H3 Image to Video, а более длинные клипы дают пространство для развития сцены. Проверьте панель параметров на этой странице, чтобы узнать точные значения, доступные в данный момент.
Исходное изображение должно иметь размер от 256 до 5760 пикселей с каждой стороны и соотношение сторон от 0,4 до 2,5, а длина приглашения может составлять от 1 до 4000 символов. Minimax H3 Image to Video не восстанавливает композицию плохо обрезанного объекта, поэтому предоставьте изображение, которое уже соответствует предполагаемому кадру. Ограничения могут различаться в зависимости от режима или настроек провайдера, поэтому подтвердите их на панели реального времени.
Сначала опишите, что физически движется, затем поведение камеры, затем освещение и настроение. Minimax H3 Image to Video лучше реагирует на конкретные глаголы и названные движения камеры, такие как медленное движение вперед или по орбите, чем на сложенные прилагательные. Избегайте смешивания двух конкурирующих визуальных стилей в одной подсказке, поскольку результат имеет тенденцию усреднять их.
При преобразовании текста в видео тема, композиция и стиль определяются с нуля, поэтому сложно дважды создать одобренный образ. Minimax H3 Image to Video удаляет эту переменную, фиксируя начальный кадр для загрузки, который подходит для снимков продукта, работы персонажей и материалов кампании, где художественное направление уже подписано. По своей конструкции это более узкий инструмент с коротким списком ввода и быстрым циклом итерации.
Да. Создайте прототип в веб-интерфейсе RunComfy AI Playground, чтобы выбрать изображение, приглашение, разрешение и продолжительность, а затем вызовите ту же модель через API RunComfy с идентичными параметрами. Это позволяет вам сохранять согласованность настроек Minimax H3 Image to Video при ручном исследовании и пакетных или запланированных заданиях в вашем собственном приложении.
Поколения потребляют доллары США или кредиты с вашего баланса RunComfy. Стоимость составляет 0,11 доллара в секунду при разрешении 768p и 0,16 доллара в секунду при разрешении 2K. Таким образом, 5-секундный клип стоит 0,55 доллара при разрешении 768p или 0,80 доллара при разрешении 2K; 10 секунд стоят 1,10 или 1,60 доллара; 15 секунд стоят 1,65 или 2,40 доллара. Новые пользователи обычно получают бесплатную пробную сумму для тестирования; по вопросам оплаты обращайтесь по адресу hi@runcomfy.com.
RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.





