电影感 4K 文生视频,输出每秒 $0.42。
本页介绍 MiniMax H3 系列中的开放权重图像到视频路径。上传第一帧,描述动作和配乐,并可选择添加最后一帧以锁定结局;该模型返回具有 480p 或 768p 的原生立体声音频的 MP4。
输出画布遵循输入图像的宽高比,因此从清晰、光线充足的静态图像开始。在 5 秒内迭代 MiniMax H3 Open Image to Video,然后在身份和相机感觉合适后进行扩展。对于不同分辨率级别的官方 MiniMax H3 图像转视频端点,请参阅 RunComfy 上的相关 MiniMax H3 型号。
电影感 4K 文生视频,输出每秒 $0.42。
根据文字生成 4–12 秒视频,支持 480p、720p、1080p、6 种宽高比,以及音频和固定镜头设置。
使用 Pikadditions 将图像中的人物或物体添加到现有视频中。
根据起始帧与结束帧生成可选原生音频的过渡视频
根据一张图片和一段音频,生成说话、唱歌或表演视频。
只需一条提示词,即可根据参考图生成流畅的 720P 或 1080P 视频。
MiniMax H3 Open Image to Video 将第一帧静止图像动画化为带有原生立体声音频的短片,可以选择由最后一帧图像引导。它适合产品展示、角色时刻和仍在剪辑的广告,此时身份应保持锁定到上传。
MiniMax H3 Open Image to Video 是具有 480p 和 768p 输出的开放权重路径。 RunComfy 上的官方 MiniMax H3 图像到视频模型使用不同的分辨率阶梯(例如 768p 和 2K)。选择 MiniMax H3 Open Image to Video 作为此页面上的开放权重路线和定价层。
MiniMax H3 Open Image to Video 需要第一帧图像和描述运动、相机和声音的提示。可选的last_image可以锁定结束姿势。分辨率为480p或768p;持续时间为 5-15 秒。输出帧遵循输入图像的长宽比。
MiniMax H3 Open Image to Video 将外观锚定到第一帧图像。在提示中写下动作动词和镜头移动,并说明哪些内容不能改变(脸部、服装、背景)。清晰、光线充足的上传内容比柔和或大量裁剪的静态图片提供更稳定的身份。
是的。 MiniMax H3 Open Image to Video 生成带有图片的原生立体声音频。添加音频:带有氛围、对话或效果入口提示的线路;否则,模型会提供适合场景的配乐。
是的。在 RunComfy 模型 UI 中进行原型设计,然后通过 RunComfy API 使用相同的参数调用相同的 MiniMax H3 Open Image to Video 模板。几代人在两条路径上消耗美元/积分。
MiniMax H3 Open Image to Video 按生成视频的每秒计费:480p 每秒 0.05 美元,768p 每秒 0.09 美元。 5 秒 480p 剪辑的成本约为 0.25 美元;成本与持续时间和分辨率成正比。
当您需要受控的结局(例如微笑、产品保持或姿势变化)同时保持第一帧的开头外观时,请在 MiniMax H3 Open Image to Video 上添加last_image。当您只想从单个静止图像中进行自由运动时,请将其留空。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





