logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Wan 2.2 S2V 音訊驅動影片產生器 | RunComfy

wan-ai/wan-2-2/speech-to-video

結合一張圖片和一段音訊,產生說話、唱歌或表演影片,輸出解析度可選 480P 或 720P。

必填的 JPG、JPEG、PNG、BMP 或 WEBP 圖片。寬度與高度都必須大於 400 畫素,且不得超過 7000 畫素。
0:00
0:00
必填的 WAV 或 MP3 音訊,時長須短於 20 秒,檔案須小於 15 MB。
可選擇 speech、sing 或 perform,預設值為 speech。
可選擇 480P 或 720P,預設值為 480P。
Idle
The rate is $0.10 per second for 480P, and $0.20 per second for 720P.

Wan 2.2 S2V 概覽

Wan 2.2 S2V 根據必填的靜態圖片和音軌產生人物影片。請按照錄音內容選擇 speech、sing 或 perform,再選擇 480P 或 720P。圖片和音訊還需滿足格式、尺寸、時長與檔案大小限制。

Wan 2.2 S2V 功能

圖片與音訊產生影片

無需文字提示詞,只需一張必填圖片和一個必填音訊檔案即可產生影片。

音訊驅動人物動作

使用錄音驅動人物影片,並根據內容選擇說話、唱歌或更廣泛的表演模式。

三種表演模式

對話選擇 speech,唱歌選擇 sing,其他表演選擇 perform;預設值為 speech。

兩種輸出解析度

預設以 480P 產生;需要更高解析度時可選擇 720P。

X 上的 Wan 2.2 S2V 動態與案例

相關模型

kling-video-o3/4K/text-to-video

電影感 4K 文字轉影片,輸出每秒 $0.42。

runway-gen-3-alpha/turbo/image-to-video

支援高擬真動畫與風格控制,Runway Gen-3 Alpha Turbo 為設計師開啟創作新境界

hunyuan-video-v1.5/image-to-video

依圖片與提示詞生成 5 秒或 8 秒的 480p 或 720p 影片。

veo-3/fast/text-to-video

從文字提示快速生成具對話和音效的動態短片

wan-2-6/video-to-video

根據文字提示詞和 1~3 段參考影片生成影片,並可設定時長、輸出尺寸、鏡頭結構、隨機種子、反向提示詞和音訊生成。

seedance-2.5/text-to-video/480p

Seedance 2.5 480p:用提示詞快速、低成本生成文生影片草稿

常見問題

Wan 2.2 S2V 需要哪些輸入?

需要一張圖片和一個音訊檔案。目前介面沒有文字提示詞輸入項。

支援哪些圖片格式?

支援 JPG、JPEG、PNG、BMP 和 WEBP。寬度與高度都必須大於 400 畫素,且不得超過 7000 畫素。

音訊檔案有什麼要求?

請使用短於 20 秒的 WAV 或 MP3,檔案大小必須小於 15 MB。

有哪些表演模式?

可選擇 speech、sing 或 perform,預設值為 speech。

可以產生哪些解析度?

可選擇 480P 或 720P,預設值為 480P。

產生費用是多少?

產生 5 秒影片需要 68 積分。

speech、sing 和 perform 應該如何選擇?

對話選擇 speech,唱歌選擇 sing,不侷限於說話或唱歌的其他表演選擇 perform。

上傳被拒絕時應該檢查什麼?

請檢查支援的檔案格式與限制。圖片必須符合尺寸要求,音訊則必須同時符合格式、時長與檔案大小限制。

Wan 2.2 S2V 支援批次產生嗎?

支援。批次大小可設為 1、2、3 或 4 個任務。

表演模式會改變圖片和音訊要求嗎?

不會。speech、sing 和 perform 使用相同的格式、尺寸、時長與檔案大小限制。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...