将起始图像制作成带原生音频的电影感短片。
Minimax H3 Image to Video 是 MiniMax H3 系列的图生视频模型,可将一张图片变成动态影像。上传首帧并描述所需动作,模型会处理主体运动、运镜和场景变化,再以固定2K分辨率生成视频。
由于上传的图片会固定为首帧,主体特征、服装、色调和构图更容易贯穿整段视频。因此,Minimax H3 Image to Video 特别适合视觉方向已经确定、只需补充动态效果的制作任务。
以下是本页面中 Minimax H3 Image to Video 可用的输入参数。
| 参数 | 必填 | 类型 | 默认值 | 范围 / 选项 | 说明 |
|---|---|---|---|---|---|
| image * | 是 (*) | string(URL) | 示例首帧 | 每边256-5760 px,宽高比0.4-2.5 | 确定主体、构图和风格的首帧。 |
| prompt * | 是 (*) | string | 示例动作描述 | 1-4000个字符 | 描述哪些内容需要移动、镜头如何运动以及场景如何发展。 |
| last_image | 否 | string(URL) | 无 | 与 image 相同的图片限制 | 用于引导视频结尾的尾帧。 |
| duration * | 是 (*) | integer | 5 | 5-15 | 视频时长,按整秒计算。 |
| resolution * | 是 (*) | string | 2k | 2k | 输出分辨率。 |
Minimax H3 Image to Video 按成片时长计费:生成2K视频的价格为每秒$0.13。
| 时长 | 价格 |
|---|---|
| 5秒 | $0.65 |
| 10秒 | $1.30 |
| 15秒 | $1.95 |
1) 上传首帧 — 选择主体清晰、构图符合目标镜头的图片。
2) 编写动作描述 — 说明什么内容需要移动、移动速度以及镜头如何运动。对 Minimax H3 Image to Video 来说,清晰的动词和运镜术语比堆叠形容词更有效。
3) 添加尾帧(可选) — 如果结尾画面很重要,请提供与首帧能够自然衔接的尾帧图片。
4) 设置时长 — 调整提示词时可先生成5秒视频;确认动作符合预期后,再延长至15秒。
5) 确认分辨率 — 所有生成结果均以2k输出。
6) 生成视频 — 提交任务,并以完整尺寸查看 Minimax H3 Image to Video 的结果。
7) 每次只调整一项 — 分别修改提示词、图片或时长,以便判断是哪项变化影响了本次结果。
如果 Minimax H3 Image to Video 不适合当前任务,还可以尝试以下模型:
将起始图像制作成带原生音频的电影感短片。
轻松将图片生成高品质动态视频,展现真实光影与自然运动效果。
将一张静态图像生成带同步音频的短视频。
使用 Seedance 1.0 根据提示词生成视频,并设置分辨率、宽高比和时长。
Alibaba 上的 HappyHorse 1.0 I2V 将静态图像动画化为原生 1080p 视频,具有物理精确的运动和身份稳定的主题。
通过遮罩或区域描述替换视频中的选定区域,并可按需使用图像和提示词。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





