从图像、视频和音频参考生成 768p 或 2K 视频


RunComfy 上的 HappyHorse 1.0 使用 Alibaba 异步视频合成 API 与 happyhorse-1.0-t2v 模型。输入文本提示词,并选择分辨率/宽高比、时长、可选种子及是否包含提供方水印。
输出格式:视频 / 分辨率:720P 或 1080P / 时长:3–15 秒 / 宽高比:16:9、9:16、1:1、4:3、3:4 / 音频:本模板未开放
| 参数 | 必填 | 类型 | 默认值 | 范围 / 选项 | 说明 |
|---|---|---|---|---|---|
| prompt* | 是 | string | — | 最多 2500 字符 | 场景、主体、运动、镜头、光线与风格。 |
| aspect_ratio | 否 | string | 16:9 | 16:9、9:16、1:1、4:3、3:4 | 生成视频宽高比。 |
| resolution | 否 | string | 1080P | 720P、1080P | 输出分辨率档位。 |
| duration | 否 | integer | 5 | 3–15 | 时长(秒)。 |
| seed | 否 | integer | 0 | 0–2147483647 | 可选种子;0 为自动。 |
| watermark | 否 | boolean | true | true、false | 是否包含提供方水印。 |
从图像、视频和音频参考生成 768p 或 2K 视频
使用 Veo 3.1 Fast,从文字或图像快速生成高质感视频,轻松实现创意与动态表达。
通过文字指令重塑现有视频,同时尽量保留源视频的动作与整体构图。
Wan 3.0 Prime 将第一帧图像快速动画化为视频
根据起始图片和提示词生成 16:9 视频,可选择时长、分辨率、帧率以及是否生成音频。
将视频中的人物或物体与背景分离,并设置输出编码、边缘优化与主体类型。
HappyHorse 1.0 是新一代 AI 视频模型,在 Artificial Analysis Video Arena 的文生视频(Elo 1333)与图生视频(Elo 1392)均排名第一。可生成原生 1080p 视频,具备先进运动合成、多镜头角色一致性与六种语言支持。
该榜单通过盲测比较同一提示词下的两段视频并投票,结果计入 Elo。截至 2026 年 4 月,HappyHorse 1.0 在文生视频与图生视频(无音频)类别均保持最高 Elo。
HappyHorse 1.0 输出原生 1080p HD,具备色彩分级与电影级细节,通常无需重度后期。
支持。HappyHorse 1.0 可一次性生成与画面对齐的音频,包括对白、环境声与拟音,在 Artificial Analysis 含音频榜单中排名第二。
原生支持六种语言:中文、英语、日语、韩语、德语、法语。对应语言的提示词可保留语言细节。
可在多镜头序列中保持角色、服装、视觉风格与氛围一致,减少镜头间手动剪辑。
可以。HappyHorse 1.0 在统一流程中支持文生视频与图生视频:上传静态图进行动画,或纯文本描述场景。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





