minimax-h3/text-to-video
MiniMax H3:768p/2K 文本转视频,带原生立体声音频
video_url 是唯一必填输入。output_codec 可选 vp9 或 h264,默认值为 h264。VP9 输出一个带 Alpha 通道的视频,H264 输出 RGB 与 Alpha 两个视频。refine_foreground_edges 默认值为 true,用于提升去背主体的边缘质量。subject_is_person 默认值同样为 true;处理物体或动物时应设为 false。video_url 提供原始视频。vp9;需要分离的 RGB 与 Alpha 输出时选择 h264。refine_foreground_edges 开启,必要时对比开关效果。subject_is_person。MiniMax H3:768p/2K 文本转视频,带原生立体声音频
根据驱动视频中的动作,让参考图片动起来。
将驱动视频中的动作迁移到参考角色图片,并可调整提示词、分辨率、推理步数、图像引导与姿态引导。
Wan 3.0 Text To Video 根据带有音频的提示制作电影剪辑
以FusionX轻松将图像生成电影质感视频,精准控制创意与细节
根据一张图片和一段音频,生成说话、唱歌或表演视频。
该模型会把 video_url 中视频的主要主体与背景分离。
可设置 video_url、output_codec、refine_foreground_edges 和 subject_is_person;只有 video_url 为必填项。
vp9 输出单个带 Alpha 通道的视频;h264 输出 RGB 与 Alpha 两个视频,也是默认编码。
refine_foreground_edges 默认值为 true,用于改善主体轮廓。面对复杂边缘时,可按需对比开启与关闭的效果。
将 subject_is_person 设为 false;主要主体是人物时,保持默认值 true。
快速运动、遮挡或细小结构可能导致不同帧的边缘表现不一致,请检查输出视频中的多个片段。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





