将视频中的人物或物体与背景分离,并设置输出编码、边缘优化与主体类型。
Omnihuman 1.5 使用一张必填人物图像和一段必填音频生成视频。页面提供两个素材 URL、选填文本指引和随机种子设置。
image_url — 必填。填写一张可直接访问的人物图像 URL。audio_url — 必填。填写用于驱动视频的音频 URL;音频必须短于 35 秒。prompt — 选填生成指引。支持中文、英语、日语、韩语、墨西哥西班牙语和印度尼西亚语。seed — 控制生成结果的整数随机种子,默认值为 -1。image_url 中填写人物图像 URL。audio_url 中填写音频 URL,并确认音频短于 35 秒。prompt 中填写简洁指引。seed,然后提交请求。输入结构未提供输出分辨率、宽高比、帧率或输出格式设置。
将视频中的人物或物体与背景分离,并设置输出编码、边缘优化与主体类型。
Kling 3.0:创建具有同步对话和一致角色的多场景电影。
将驱动视频中的动作迁移到参考角色图片,并可调整提示词、分辨率、推理步数、图像引导与姿态引导。
根据必填文字提示词生成视频,并精确控制宽高比、分辨率、时长、风格、随机种子、音频、多片段和提示词优化。
根据文本提示词生成带同步音频的电影级视频。
将起始静帧动画化为可选原生音频的短视频
它会根据必填 image_url 中的人物图像和必填 audio_url 中的音频生成视频,还可设置选填的 prompt 和 seed。
image_url 和 audio_url 为必填字段;prompt 和 seed 为选填设置。
请填写一张可直接访问的人物图像 URL,作为视频画面来源。
audio_url 中的音频必须短于 35 秒。
prompt 支持中文、英语、日语、韩语、墨西哥西班牙语和印度尼西亚语。
seed 是控制生成结果的整数随机种子,默认值为 -1。
请确认 image_url 和 audio_url 可直接访问,并确保音频短于 35 秒。
输入结构未提供输出分辨率、宽高比、帧率或输出格式字段。
填写 image_url 和 audio_url,确保音频短于 35 秒;如使用 prompt,请选用支持的语言,并在提交前检查 seed。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。




