logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Wan 2.2 S2V 音频驱动视频生成器 | RunComfy

wan-ai/wan-2-2/speech-to-video

结合一张图片和一段音频,生成说话、唱歌或表演视频,输出分辨率可选 480P 或 720P。

必填的 JPG、JPEG、PNG、BMP 或 WEBP 图片。宽和高都必须大于 400 像素且不超过 7000 像素。
0:00
0:00
必填的 WAV 或 MP3 音频,时长须短于 20 秒,文件须小于 15 MB。
可选择 speech、sing 或 perform,默认值为 speech。
可选择 480P 或 720P,默认值为 480P。
Idle
The rate is $0.10 per second for 480P, and $0.20 per second for 720P.

Wan 2.2 S2V 概览

Wan 2.2 S2V 根据必填的静态图片和音轨生成人物视频。请按照录音内容选择 speech、sing 或 perform,再选择 480P 或 720P。图片和音频还需满足格式、尺寸、时长与文件大小限制。

Wan 2.2 S2V 功能

图片与音频生成视频

无需文本提示词,只需一张必填图片和一个必填音频文件即可生成视频。

音频驱动人物动作

使用录音驱动人物视频,并根据内容选择说话、唱歌或更广泛的表演模式。

三种表演模式

对话选择 speech,唱歌选择 sing,其他表演选择 perform;默认值为 speech。

两种输出分辨率

默认以 480P 生成;需要更高分辨率时可选择 720P。

X 上的 Wan 2.2 S2V 动态与案例

相关模型

seedance-2.5/reference-to-video/480p

Seedance 2.5 参考 480p:以较低成本进行多参考草稿视频

pixverse-c1/image-to-video

根据文本、图像、过渡和参考创建可用于影片的剪辑。

ai-avatar/v2/pro

根据 1 张必填图片和 1 个必填音频文件生成数字人视频,并可用文字提示词补充生成指令。

pixverse-v6/image-to-video

从图像、文本、参考资料或视频创建受控的1080p剪辑。

kling-2-6/pro/text-to-video

输入文字即可生成短视频,并可设置时长、宽高比与是否生成音频。

ltx-2/pro/text-to-video

根据必填提示词生成视频,可精确选择 6、8 或 10 秒,1080p~2160p,25 或 50 FPS,固定 16:9,并可生成音频。

常见问题

Wan 2.2 S2V 需要哪些输入?

需要一张图片和一个音频文件。当前界面没有文本提示词输入项。

支持哪些图片格式?

支持 JPG、JPEG、PNG、BMP 和 WEBP。宽和高都必须大于 400 像素且不超过 7000 像素。

音频文件有什么要求?

请使用短于 20 秒的 WAV 或 MP3,文件大小必须小于 15 MB。

有哪些表演模式?

可选择 speech、sing 或 perform,默认值为 speech。

可以生成哪些分辨率?

可选择 480P 或 720P,默认值为 480P。

生成费用是多少?

生成 5 秒视频需要 68 积分。

speech、sing 和 perform 应该如何选择?

对话选择 speech,唱歌选择 sing,不局限于说话或唱歌的其他表演选择 perform。

上传被拒绝时应该检查什么?

请检查支持的文件类型和限制。图片必须满足尺寸条件,音频必须同时满足格式、时长和文件大小条件。

Wan 2.2 S2V 支持批量生成吗?

支持。批量大小可设为 1、2、3 或 4 个任务。

表演模式会改变图片和音频要求吗?

不会。speech、sing 和 perform 使用相同的格式、尺寸、时长与文件大小限制。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • 查看所有模型 →
图像模型
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...