logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Omnihuman 1.5:人物图像与音频视频生成器 | RunComfy

bytedance/omnihuman/v1.5

根据一张必填人物图像和一段 35 秒以内的必填音频生成视频。可使用六种支持语言填写选填生成指引,并设置默认值为 -1 的随机种子。

用作视频画面来源的人物图像必填 URL。
0:00
0:00
用于驱动视频的音频必填 URL。音频必须短于 35 秒。
选填生成指引。支持中文、英语、日语、韩语、墨西哥西班牙语和印度尼西亚语。
控制生成结果的整数随机种子,默认值为 -1。
Idle
The rate is $0.18 per second.

Omnihuman 1.5

Omnihuman 1.5 会根据必填 `image_url` 中的人物图像和必填 `audio_url` 中的音频生成视频。音频必须短于 35 秒。选填的 `prompt` 支持中文、英语、日语、韩语、墨西哥西班牙语和印度尼西亚语;还可按需设置默认值为 -1 的 `seed`。

Omnihuman 1.5 概述#


Omnihuman 1.5 使用一张必填人物图像和一段必填音频生成视频。页面提供两个素材 URL、选填文本指引和随机种子设置。


输入与设置#


  • image_url — 必填。填写一张可直接访问的人物图像 URL。
  • audio_url — 必填。填写用于驱动视频的音频 URL;音频必须短于 35 秒。
  • prompt — 选填生成指引。支持中文、英语、日语、韩语、墨西哥西班牙语和印度尼西亚语。
  • seed — 控制生成结果的整数随机种子,默认值为 -1。

建议流程#


  1. 在 image_url 中填写人物图像 URL。
  2. 在 audio_url 中填写音频 URL,并确认音频短于 35 秒。
  3. 如有需要,使用六种支持语言之一在 prompt 中填写简洁指引。
  4. 如需明确控制随机种子,请设置 seed,然后提交请求。

输入结构未提供输出分辨率、宽高比、帧率或输出格式设置。


相关模型

video-background-removal/video-to-video

将视频中的人物或物体与背景分离,并设置输出编码、边缘优化与主体类型。

kling-3.0/standard/text-to-video

Kling 3.0:创建具有同步对话和一致角色的多场景电影。

one-to-all-animation/14b

将驱动视频中的动作迁移到参考角色图片,并可调整提示词、分辨率、推理步数、图像引导与姿态引导。

pixverse/v5.5/text-to-video

根据必填文字提示词生成视频,并精确控制宽高比、分辨率、时长、风格、随机种子、音频、多片段和提示词优化。

gemini-omni-flash/text-to-video

根据文本提示词生成带同步音频的电影级视频。

flux-3/image-to-video

将起始静帧动画化为可选原生音频的短视频

常见问题

Omnihuman 1.5 可以做什么?

它会根据必填 image_url 中的人物图像和必填 audio_url 中的音频生成视频,还可设置选填的 prompt 和 seed。

哪些字段是必填的?

image_url 和 audio_url 为必填字段;prompt 和 seed 为选填设置。

`image_url` 应该填写什么?

请填写一张可直接访问的人物图像 URL,作为视频画面来源。

音频长度有什么限制?

audio_url 中的音频必须短于 35 秒。

`prompt` 支持哪些语言?

prompt 支持中文、英语、日语、韩语、墨西哥西班牙语和印度尼西亚语。

`seed` 如何使用?

seed 是控制生成结果的整数随机种子,默认值为 -1。

提交素材前需要检查什么?

请确认 image_url 和 audio_url 可直接访问,并确保音频短于 35 秒。

页面提供哪些输出设置?

输入结构未提供输出分辨率、宽高比、帧率或输出格式字段。

提交前的最终检查项有哪些?

填写 image_url 和 audio_url,确保音频短于 35 秒;如使用 prompt,请选用支持的语言,并在提交前检查 seed。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Omnihuman 1.5 生成示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...