logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

MiniMax H3 Max:Models and API 上带有本机音频的视频 | RunComfy

minimax/minimax-h3-max/image-to-video

MiniMax H3 Max 从文本或第一帧创建 5-15 秒的视频(通常是大约十几秒内的 10 秒剪辑),并使用 480p 或 768p 的原生音频。

用作第一帧的图像的 URL。输出纵横比遵循该图像。
视频生成的文本提示:动作、相机、灯光、风格和可选音频。
用作从第一个到最后一个关键帧生成的最后一帧的图像的可选 URL。
视频的持续时间(以秒为单位)。
视频的本机生成分辨率。
生成前要花多少精力重写提示。 balanced 返回很快; quality 在更丰富的提示上花费更长的时间。
随机种子。省略时选择随机种子。使用 -1 表示随机。
如果设置为 true,将启用安全检查器。
Idle
The rate is $0.055 per second for 480p, and $0.088 per second for 768p.

MiniMax H3 Max 简介

MiniMax 的 MiniMax H3 Max 将文本或静止图像转换为短片,并在 480p 或 768p 上匹配声音,通常在大约十几秒内提供 10 秒的视频。
MiniMax H3 Max 不再需要漫长的等待和延迟的音频同步,而是要一份涵盖摄像机、动作和声音的简报,帮助营销人员、预览艺术家和社交团队更快地进行迭代。
对于开发人员来说,RunComfy 上的 MiniMax H3 Max 既可以在浏览器中使用,也可以通过 HTTP API 使用,因此您无需自行托管或扩展模型。
非常适合:广告故事板|产品动态|社交挂钩

MiniMax / MiniMax H3 Max#


MiniMax H3 Max 是 MiniMax 的经过训练的 H3 视频系列,用于将图片和声音一起渲染的短片 - 它是为速度而构建的。 10 秒的剪辑通常会在大约十几秒内返回,因此您可以在紧密的循环中起草、修改和锁定镜头。


在 RunComfy 上,您可以从书面镜头列表开始(文本到视频)或锁定静止图像(图像到视频)的开头帧,然后可以选择用最后一帧来引导结尾。


此页面运行图像到视频的路径。当您更喜欢仅从文字中发明第一帧时,同级文本到视频页面共享相同的 MiniMax H3 Max 系列。不管怎样,MiniMax H3 Max 的目标是在没有单独音频通道的情况下实现强烈的提示跟随。


亮点#


  • 快速周转: MiniMax H3 Max 通常在大约十几秒内生成 10 秒的视频,保持迭代接近实时。
  • 两个切入点: 为文本转视频编写完整的简介,或上传图像转视频的静态图片; MiniMax H3 Max 让动作、灯光和音频一次性保持一致。
  • 迅速遵守: 使用 MiniMax H3 Max,节拍将按照您编写的顺序进行播放 — 摄像机移动、主体动作和屏幕时间都更接近简报。
  • 原生音频: MiniMax H3 Max 在与图片相同的通道中渲染房间音调、拟音、对话提示和氛围。
  • 从第一个到最后一个控制: 在此图像到视频页面上,设置开始图像和可选的结束图像,以便镜头在两个批准的帧之间移动。
  • 提示扩展: 选择balanced进行快速重写,或者在生成前想要更丰富的扩展时选择quality。
  • 实用长度: 在“480p”或“768p”生成 5-15 秒的剪辑,用于草稿和交付就绪预览。

## 参数


参数必填类型默认范围/选项描述
image_url *是 (*)字符串(URL)第一帧示例图片网址锚定主题、构图和风格的开放框架。长宽比遵循此图像。
提示*是 (*)字符串动议简介样本文字动作、摄像机、灯光、风格和可选的音频方向。
end_image_url没有字符串(URL)无图片网址可选的最后一帧用于生成第一个到最后一个关键帧。
持续时间没有整数55-155-15剪辑长度以整秒为单位。
分辨率没有字符串768p480p、768p本机生成分辨率。
prompt_expansion_mode *是 (*)字符串balancedbalanced、quality生成前要花多少精力重写提示。
种子没有整数随机整数固定种子以获得可重复的结果;省略随机种子。
enable_safety_checker没有布尔真实真,假为 true 时启用安全检查器。

定价#


分辨率价格
480p$0.055 每秒
768p每秒 $0.088

MiniMax H3 Max 的计费遵循生成的剪辑持续时间。检查此页面上的“生成”部分以获取实时信用估算。


如何使用#


  1. 上传一张清晰的第一帧图像,该图像已经具有您想要的取景和外观。
  2. 编写一个提示,其中包括动作、摄像机移动、灯光以及您需要的任何声音。
  3. 如果镜头必须在特定的结束帧上结束,则可以选择添加结束图像。
  4. 将持续时间设置在 5 到 15 秒之间。
  5. 选择“480p”以获得更便宜的 MiniMax H3 Max 汇票,或选择“768p”以获得更迅速的交割。
  6. 选择balanced或quality提示扩展,然后生成。
  7. 一起回顾MiniMax H3 Max图片和音频;调整摘要或种子并根据需要重新运行。
  8. 当您转向自动化时,通过 RunComfy API 调用相同的 MiniMax H3 Max 参数。

提示和参考提示#


  • 以主题和主要动作为主导,然后添加相机路径和灯光。
  • 将音频方向放在同一提示中(例如:脚步声、房间音调、简短的对话)。
  • 对于从第一个到最后一个镜头,使开始和结束图像共享身份、服装和调色板。
  • 更喜欢每个 MiniMax H3 Max 剪辑有一个连续的摄像机创意,而不是许多相互冲突的动作。
  • 当简报稀疏时使用quality扩展;当提示已经详细时使用“balanced”。
  • 如果您需要 MiniMax H3 Max 的清晰文字,请保持屏幕上的文本请求明确且简短。
  • 将持续时间与您编写的节拍相匹配,这样时间线就不会过度拥挤。
  • 当每个节拍都是具体的而不是模糊的情绪词时,MiniMax H3 Max 反应最好。

当您需要纯文本到视频而不是静止图像时,请打开 RunComfy 上的同级 MiniMax H3 Max 文本页面。此图像到视频路线是保留经过批准的第一帧的地方,而 MiniMax H3 Max 处理运动和声音。


工作室经常在概念板和静态产品镜头中保留 MiniMax H3 Max ,以便外观在不同模式下保持一致。


MiniMax H3 Max 与其他型号相比如何#


  • 与基础 MiniMax H3 相比:MiniMax H3 Max 是训练后的路径,经过调整,可在 480p/768p 处实现更严格的提示跟随和更强的美感。
  • 与MiniMax H3 Open:公开赛是无重量级路线; MiniMax H3 Max 的目标是训练后最大 quality 和 RunComfy 上的吞吐量曲线。
  • 与 Hailuo 2.3 Pro 相比:Hailuo 仍然是 MiniMax 生产的强大选择;当您需要较新的最大依从性和本机音频工作流程时,请选择 MiniMax H3 Max。
  • 根据公开信息,在锁定管道之前跨模型运行相同的概要。

更多模型可供尝试#


  • MiniMax H3 Max text to video — 使用相同的 Max 系列单独从文本发明第一帧。
  • MiniMax H3 图像到视频 — 官方 H3 图像到视频,带有 768p 和 2K 选项。
  • MiniMax H3 — H3 文本到视频,具有 768p 和 2K 层。
  • MiniMax H3 Open 图像到视频 — 开放权重 H3 图像到视频,位于 480p/768p。
  • Hailuo 2.3 Pro 图像到视频 — 如果 MiniMax H3 Max 不适合,则使用较早的 MiniMax 生产图像到视频路径。

官方资源#


对于此 MiniMax H3 Max 页面之外的产品更新:


  • MiniMax官方网站
  • MiniMax H3 发布帖子

相关模型

wan-3.0-prime/image-to-video

Wan 3.0 Prime 将第一帧图像快速动画化为视频

ltx-2-19b/text-to-video/lora

根据提示词生成音视频同步的动态短片,并精确控制 LoRA 风格。

wan-2-2/animate/video-to-video

使用参考图和源视频生成动画视频,可选择输出尺寸并设置随机种子。

runway-gen-4/turbo/image-to-video

精准匹配文本提示,生成动作真实、结构连贯的视频内容

kling-2-6/motion-control-standard

以 AI 精准迁移动作,快速生成稳定流畅的角色动画。

luma-ray-2/image-to-video

轻松将静态图像转为动态视频,拥有自然光影与流畅动画效果,为创作者解锁全新视觉表现力。

常见问题

MiniMax H3 Max 最擅长视频生成什么?

MiniMax H3 Max 专为短片而构建,其中图像和声音是从文本摘要或第一帧静态图像一起创建的。当您需要清晰的摄像机移动、有序的动作节拍以及无需单独声音通道的匹配音频时,它非常适合。

MiniMax H3 Max 支持文本转视频和图像转视频吗?

是的。当您从文字创建第一帧时,MiniMax H3 Max 涵盖文本到视频,以及当您锁定开场静态时,涵盖图像到视频。本页面重点关注图像到视频;使用同级文本到视频页面作为纯文本路径。

MiniMax H3 Max 可以使用最后一帧来拍摄从第一个到最后一个镜头吗?

在图像到视频的路线上,MiniMax H3 Max 接受可选的结束图像,以便剪辑从开始帧向选定的结束帧移动。保持两张剧照之间的拍摄对象身份、着装和调色板一致,以实现更清晰的过渡。

MiniMax H3 Max 支持哪些分辨率和持续时间?

MiniMax H3 Max 在 480p 或 768p 处生成持续时间为 5 到 15 秒的剪辑。选择 480p 以获得更便宜的汇票,选择 768p 当您需要更快速的交割时;检查 RunComfy 参数面板的实时控制。

MiniMax H3 Max 中的即时扩展如何工作?

MiniMax H3 Max 提供 balanced 和 quality 提示扩展模式。平衡快速重写摘要; quality 在生成之前花费更长的时间构建更丰富的提示。对于稀疏的摘要,请使用 quality;当您的提示已经很详细时,请使用 balanced。

MiniMax H3 Max 是否随视频生成音频?

是的。 MiniMax H3 Max 返回与图片同步的音频,因此您可以在同一提示中控制氛围、拟音或对话提示。如果省略音频方向,模型仍会根据场景提供配乐。

开发人员可以通过 RunComfy API 使用 MiniMax H3 Max 吗?

是的。在 RunComfy Web UI 中对 MiniMax H3 Max 进行原型设计,然后通过 RunComfy API 使用相同的参数调用相同的模型以进行生产或自动化。您不需要自己托管或扩展模型。

在 RunComfy 上使用 MiniMax H3 Max 生成需要多少钱?

MiniMax H3 Max 按生成的视频每秒计费:480p 每秒 $0.055,768p 每秒 $0.088。几代人消费美元或信用;在运行之前,请检查此页面上的“生成”部分以获取实时估计。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • Wan 3.0 Prime Reference To Video
  • Wan 3.0 Prime
  • Wan 3.0 Prime Text To Video
  • Wan 2.6 Flash
  • MiniMax H3 Open Image to Video
  • MiniMax H3 Open
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Qwen Image 3.0 Pro Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2 Image Edit
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

MiniMax H3 Max 的示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...