快速、低成本的多镜头 AI 视频模型,原生支持音频和参考素材。
Hunyuan Video 1.5 Text-to-Video 会根据必填的文字提示词生成 5 秒或 8 秒视频。
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| prompt | string | 必填;已预填示例 | 描述场景、动作、运动和镜头方式。 |
| negative_prompt | string | 可选;默认为空 | 描述不希望出现在生成视频中的元素。 |
| size | string | 默认:832*480 | 可选 832480、480832、1280720 或 7201280。 |
| duration | integer | 5 或 8;默认:5 | 视频时长,单位为秒。 |
| seed | integer | 默认:0 | 用于控制生成过程的随机种子。 |
prompt 中描述主体、环境、动作、节奏和镜头移动。negative_prompt 中加入不希望出现的元素。size 值之一。duration 设为 5 秒或 8 秒。seed,并检查返回的视频。快速、低成本的多镜头 AI 视频模型,原生支持音频和参考素材。
根据文字提示词生成视频,可选择宽高比以及 5 秒或 10 秒时长。
精确重制音轨中的指定片段,其余部分保持不变。
根据必填视频 URL 和音频 URL 创建口型同步视频。可选择 `lipsync-2` 或 `lipsync-2-pro`;相同时长下,Pro 费用约为基础版的 1.67 倍。另有五种时长不一致处理模式。
提示词驱动的视频编辑,在多镜头片段中保留原始运动
将文字图像一键转化为电影级视频,支持角色一致与风格统一
它会根据必填文字字段 prompt 生成视频。
描述主体、环境、动作、运动、节奏和镜头方式。
negative_prompt 为可选项,可描述不希望出现在视频中的元素。
可选 832*480、480*832、1280*720 或 720*1280,默认值为 832*480。
duration 支持 5 秒或 8 秒,默认值为 5 秒。
seed 是整数,默认值为 0。提示词和其他设置不变时复用同一随机种子,有助于复现相同的请求条件。
不需要。这是文生视频工作流,唯一的必填字段是 prompt。
可以。横向输出使用 832*480 或 1280*720,竖向输出使用 480*832 或 720*1280。
不可以。此模型的 duration 枚举仅包含 5 和 8。
确认已填写 prompt,size 属于四个可选值之一,duration 为 5 或 8,并且可选的 negative_prompt 已清楚描述排除项。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





