logo
RunComfy
  • ComfyUI
  • トレーナー新着
  • モデル
  • API
  • 価格
discord logo
モデル
探索
すべてのモデル
ライブラリ
生成履歴
モデルAPI
APIドキュメント
APIキー
アカウント
使用量

Wan 2.2 S2V:音声駆動動画生成 | RunComfy

wan-ai/wan-2-2/speech-to-video

1枚の画像と1つの音声ファイルを組み合わせ、会話、歌唱、パフォーマンスの人物動画を480Pまたは720Pで生成します。

必須のJPG、JPEG、PNG、BMP、WEBP画像です。幅と高さはいずれも400ピクセルより大きく、7000ピクセル以下にしてください。
0:00
0:00
20秒未満かつ15 MB未満の必須WAVまたはMP3音声です。
speech、sing、performから選択します。初期値はspeechです。
480Pまたは720Pを選択します。初期値は480Pです。
Idle
The rate is $0.10 per second for 480P, and $0.20 per second for 720P.

Wan 2.2 S2Vの概要

Wan 2.2 S2Vは、必須の静止画像と音声トラックから人物動画を生成します。録音内容に合わせてspeech、sing、performを選び、解像度を480Pまたは720Pに設定します。画像と音声には、形式、寸法、長さ、ファイルサイズの制限があります。

Wan 2.2 S2Vの機能

画像と音声から生成

テキストプロンプトを使わず、必須の画像1枚と音声ファイル1つから動画を作成します。

音声に合わせた人物の動き

録音をもとに人物動画を動かし、会話、歌唱、または幅広いパフォーマンスに合うモードを選べます。

3つのパフォーマンスモード

会話にはspeech、歌声にはsing、それ以外の演技にはperformを選びます。初期値はspeechです。

2つの出力解像度

初期値の480Pに加え、より高い解像度が必要な場合は720Pを選択できます。

Xで見るWan 2.2 S2Vのニュースと作例

関連モデル

seedance-2.0/fast

マルチモーダル参照、リップシンク、カメラ制御を使って、映画的な短編動画をすばやく生成します。

kling/lipsync/audio-to-video

必須の動画URLと音声URLを使って、既存動画に音声を同期します。

seedance-2.5/text-to-video/720p

Seedance 2.5一貫性を高め、より長いクリップに対応するシネマティックAI動画

minimax-h3-open/reference-to-video

画像、ビデオ、およびオーディオ キューからビデオへの参照をオープンウェイトします。

seedance-v1.5-pro/text-to-video

480p、720p、または 1080p でテキストから 4 ~ 12 秒の動画を生成します。6 つのアスペクト比と音声および固定カメラのコントロールを使用できます。

video-background-removal/video-to-video

動画内の人物や物体を背景から分離し、コーデック、輪郭調整、被写体タイプを設定できます。

よくある質問

Wan 2.2 S2Vには何を入力しますか?

画像1枚と音声ファイル1つが必須です。この画面にはテキストプロンプト入力はありません。

対応している画像形式は?

JPG、JPEG、PNG、BMP、WEBPに対応します。幅と高さはいずれも400ピクセルより大きく、7000ピクセル以下にしてください。

音声ファイルの条件は?

20秒未満のWAVまたはMP3を使用します。ファイルサイズは15 MB未満にしてください。

どのパフォーマンスモードを選べますか?

speech、sing、performから選べます。初期値はspeechです。

どの解像度で生成できますか?

480Pまたは720Pです。初期値は480Pです。

生成に必要なクレジットは?

5秒の動画生成には68クレジットが必要です。

speech、sing、performはどう使い分けますか?

会話にはspeech、歌声にはsing、会話や歌唱に限定されない幅広い演技にはperformを選びます。

アップロードが拒否される場合は何を確認しますか?

対応形式と制限を確認してください。画像は寸法条件、音声は形式、長さ、ファイルサイズの各条件を満たす必要があります。

Wan 2.2 S2Vはバッチ生成に対応していますか?

はい。バッチサイズは1、2、3、4から選択できます。

パフォーマンスモードによって画像や音声の条件は変わりますか?

いいえ。speech、sing、performのいずれも、形式、寸法、長さ、ファイルサイズの制限は同じです。

フォローする
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
サポート
  • Discord
  • メール
  • システムステータス
  • アフィリエイト
ビデオモデル
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • すべてのモデルを見る →
画像モデル
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • すべてのモデルを見る →
法的情報
  • 利用規約
  • プライバシーポリシー
  • Cookieポリシー
RunComfy
著作権 2026 RunComfy. All Rights Reserved.

RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...