logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Wan 2.2 S2V 音訊驅動影片產生器 | RunComfy

wan-ai/wan-2-2/speech-to-video

結合一張圖片和一段音訊,產生說話、唱歌或表演影片,輸出解析度可選 480P 或 720P。

必填的 JPG、JPEG、PNG、BMP 或 WEBP 圖片。寬度與高度都必須大於 400 畫素,且不得超過 7000 畫素。
0:00
0:00
必填的 WAV 或 MP3 音訊,時長須短於 20 秒,檔案須小於 15 MB。
可選擇 speech、sing 或 perform,預設值為 speech。
可選擇 480P 或 720P,預設值為 480P。
Idle
The rate is $0.10 per second for 480P, and $0.20 per second for 720P.

Wan 2.2 S2V 概覽

Wan 2.2 S2V 根據必填的靜態圖片和音軌產生人物影片。請按照錄音內容選擇 speech、sing 或 perform,再選擇 480P 或 720P。圖片和音訊還需滿足格式、尺寸、時長與檔案大小限制。

Wan 2.2 S2V 功能

圖片與音訊產生影片

無需文字提示詞,只需一張必填圖片和一個必填音訊檔案即可產生影片。

音訊驅動人物動作

使用錄音驅動人物影片,並根據內容選擇說話、唱歌或更廣泛的表演模式。

三種表演模式

對話選擇 speech,唱歌選擇 sing,其他表演選擇 perform;預設值為 speech。

兩種輸出解析度

預設以 480P 產生;需要更高解析度時可選擇 720P。

X 上的 Wan 2.2 S2V 動態與案例

相關模型

minimax-h3-open/text-to-video

開放式文字轉視頻,具有 480p/768p 和原生立體聲音頻。

kling-video-o3/standard/video-to-video

按輸出影片每秒 $0.126,透過提示詞編輯影片。

ltx-2/retake-video

根據提示詞重做現有影片中的指定片段,並可選擇替換音訊、畫面或同時替換兩者。

gemini-omni-flash/video-edit

根據文字指令編輯來源影片,同時維持場景結構與動作連貫。

lucy-edit/restyle

透過文字指令重新詮釋現有影片,同時盡量保留來源影片的動作與整體構圖。

kling-3.0/4k/image-to-video

將靜態圖片製作成原生 4K 電影感影片,支援首尾影格引導與同步音訊。

常見問題

Wan 2.2 S2V 需要哪些輸入?

需要一張圖片和一個音訊檔案。目前介面沒有文字提示詞輸入項。

支援哪些圖片格式?

支援 JPG、JPEG、PNG、BMP 和 WEBP。寬度與高度都必須大於 400 畫素,且不得超過 7000 畫素。

音訊檔案有什麼要求?

請使用短於 20 秒的 WAV 或 MP3,檔案大小必須小於 15 MB。

有哪些表演模式?

可選擇 speech、sing 或 perform,預設值為 speech。

可以產生哪些解析度?

可選擇 480P 或 720P,預設值為 480P。

產生費用是多少?

產生 5 秒影片需要 68 積分。

speech、sing 和 perform 應該如何選擇?

對話選擇 speech,唱歌選擇 sing,不侷限於說話或唱歌的其他表演選擇 perform。

上傳被拒絕時應該檢查什麼?

請檢查支援的檔案格式與限制。圖片必須符合尺寸要求,音訊則必須同時符合格式、時長與檔案大小限制。

Wan 2.2 S2V 支援批次產生嗎?

支援。批次大小可設為 1、2、3 或 4 個任務。

表演模式會改變圖片和音訊要求嗎?

不會。speech、sing 和 perform 使用相同的格式、尺寸、時長與檔案大小限制。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...