Geração de vídeo Pro orientada por referências, de 3–15 s, a partir de US$ 0,112 por segundo.
Minimax H3 Image to Video is MiniMax's H3-series model for turning one picture into moving footage. You hand it the opening frame and describe what should happen; the model resolves motion, camera behavior, and scene development, then renders at 768p or 2K.
Because the first frame is pinned by your upload, subject identity, wardrobe, palette, and framing carry through the clip. Minimax H3 Image to Video therefore fits work where the look is settled and only movement is missing.
768p for cheaper drafts or 2k when faces, packaging text, and fine texture need to survive a full-screen crop.These are the live fields for Minimax H3 Image to Video on this page.
| Parameter | Required | Type | Default | Range / Options | Description |
|---|---|---|---|---|---|
| image * | Yes (*) | string (URL) | Sample first frame | 256-5760 px per side, aspect ratio 0.4-2.5 | Opening frame that anchors subject, composition, and style. |
| prompt * | Yes (*) | string | Sample motion brief | 1-4000 characters | What should move, how the camera behaves, how the scene develops. |
| last_image | No | string (URL) | None | Same image constraints as image | Closing frame used to steer where the clip ends. |
| duration * | Yes (*) | integer | 5 | 4-15 | Clip length in whole seconds. |
| resolution * | Yes (*) | string | 768p | 768p, 2k | Output resolution tier. |
Minimax H3 Image to Video bills on resolution and the length of the finished clip:
| Resolution | Price per second | 5s | 10s | 15s |
|---|---|---|---|---|
| 768p | $0.11 | $0.55 | $1.10 | $1.65 |
| 2K | $0.16 | $0.80 | $1.60 | $2.40 |
1) Upload the opening frame — Pick an image where the subject reads clearly and the composition matches the shot you want.
2) Write the motion brief — Say what moves, how fast, and what the camera does. Minimax H3 Image to Video answers to verbs and camera language, not adjective lists.
3) Add a closing frame (optional) — Supply a last image when the ending matters, and keep it compatible with the first frame.
4) Set the length — Start at 5 seconds while tuning wording, then extend toward 15 once the motion behaves.
5) Choose the resolution — Use 768p for drafts; switch to 2k for final deliveries that need more detail.
6) Generate — Submit and review the Minimax H3 Image to Video result at full size.
7) Iterate one variable at a time — Swap the prompt, image, duration, or resolution separately so you can tell what changed the take.
When Minimax H3 Image to Video is not the right fit, these are worth a pass:
Geração de vídeo Pro orientada por referências, de 3–15 s, a partir de US$ 0,112 por segundo.
Gere um vídeo 16:9 a partir de uma imagem e um prompt, com duração, resolução, taxa de quadros e áudio opcionais.
Aumente os clipes existentes além do quadro final com movimento consistente com a cena
Transforme imagens estáticas em vídeos realistas e detalhados em 2K.
Transforme imagens em vídeos envolventes com Hailuo 2.3 e controle artístico total.
Crie vídeos envolventes a partir de imagens com som sincronizado
O Minimax H3 Image to Video tira uma imagem estática mais um resumo de movimento escrito e retorna um videoclipe 768p ou 2K. Ele foi desenvolvido para transformar arte, fotografia de produto ou quadro renderizado em uma cena em movimento sem reconstruir a cena em uma ferramenta 3D ou de composição. A imagem enviada fixa o quadro de abertura, para que o assunto e o enquadramento que você já aprovou sejam transportados para o clipe.
Além do primeiro quadro obrigatório, o Minimax H3 Image to Video aceita uma última imagem opcional que orienta como o clipe termina. O modelo calcula o movimento entre as duas imagens estáticas, em vez de derivar em direção a um estado final arbitrário. Mantenha as duas imagens visualmente compatíveis em iluminação, paleta e enquadramento, ou a transição parecerá forçada.
A resolução de saída pode ser selecionada como 768p ou 2k, e a duração é selecionável de 4 a 15 segundos em segundos inteiros. Clipes mais curtos são a escolha prática enquanto você ainda está testando o texto imediato com o Minimax H3 Image to Video, e clipes mais longos oferecem espaço para a cena se desenvolver. Verifique o painel de parâmetros nesta página para obter os valores exatos atualmente expostos.
A imagem de origem deve medir entre 256 e 5.760 pixels de cada lado com proporção entre 0,4 e 2,5, e o prompt aceita de 1 a 4.000 caracteres. O Minimax H3 Image to Video não recompõe um assunto mal cortado, portanto, forneça uma imagem que já corresponda ao enquadramento pretendido. Os limites podem variar de acordo com o modo ou configurações do provedor, portanto, confirme no painel ao vivo.
Descreva o que se move fisicamente primeiro, depois o comportamento da câmera, depois a iluminação e o clima. O Minimax H3 Image to Video responde melhor a verbos concretos e movimentos de câmera nomeados, como um push-in lento ou uma órbita, do que a adjetivos empilhados. Evite misturar dois estilos visuais concorrentes em um prompt, pois o resultado tende a fazer uma média entre eles.
A conversão de texto em vídeo decide o assunto, a composição e o estilo do zero, o que torna difícil acertar duas vezes um visual aprovado. O Minimax H3 Image to Video remove essa variável bloqueando o quadro de abertura do seu upload, o que se adapta a fotos de produtos, trabalho de personagens e material de campanha onde a direção de arte já está assinada. É uma ferramenta mais restrita por design, com uma lista de entradas curta e um loop de iteração rápido.
Sim. Crie um protótipo na interface da Web do RunComfy AI Playground para definir sua imagem, prompt, resolução e duração e, em seguida, chame o mesmo modelo por meio da API RunComfy com parâmetros idênticos. Isso permite manter as configurações de imagem para vídeo do Minimax H3 consistentes entre a exploração manual e trabalhos em lote ou agendados em seu próprio aplicativo.
As gerações consomem dólares ou créditos do seu saldo RunComfy. A taxa é de US$ 0,11 por segundo em 768p e US$ 0,16 por segundo em 2K. Portanto, um clipe de 5 segundos custa US$ 0,55 em 768p ou US$ 0,80 em 2K; 10 segundos custam US$ 1,10 ou US$ 1,60; 15 segundos custam US$ 1,65 ou US$ 2,40. Novos usuários normalmente recebem um valor de teste gratuito para testar; para dúvidas sobre cobrança, entre em contato com hi@runcomfy.com.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.





