開始静止画と終了静止画を滑らかな映画のようなビデオにブリッジします
Wan 3.0 は、テキスト、画像、ビデオ、オーディオ、ファイル、Web ページを、同期したサウンドを備えた一貫したクリップに変換する Wan-AI のオールインワン ビデオ生成モデルです。このページには Wan 3.0 Image to Video が用意されています。最初のフレームの画像とプロンプトを指定すると、そのフレームが 2 ~ 30 秒のクリップにアニメーション化され、オプションでショットの終了方法を固定する最後のフレームも追加されます。同じ基礎となるモデルでテキストからビデオへの変換や参照からビデオへの変換も実行されるため、ここで開発した外観はファミリー全体に転送されます。
| Wan 3.0 の利点 | それはあなたにとって何を意味しますか |
|---|---|
| 1 つのモデル、多数の入力 | Wan 3.0 はテキスト、最初/最後のフレーム画像、参照画像、ビデオ、オーディオ、ドキュメント、リンクを処理するため、アイデア間でツールを切り替える必要はほとんどありません。 |
| 最初と最後のフレームの制御 | このページでは、開始フレームと終了フレームの両方を設定できるため、Wan 3.0 は最初のフレームのみのアニメーションよりもショットの開始方法と解決方法をより厳密に制御できます。 |
| 柔軟な 2 ~ 30 秒の出力 | Wan 3.0 は短いドラフトまたは長いシングルテイクをレンダリングするため、素早い反復と完成したショットが同じエンドポイントから得られます。 |
| 同期オーディオ、オプション | すべての Wan 3.0 結果には、一致するオーディオ トラックを含めることができます。また、サイレント クリップをエクスポートすることもできます。オーディオを切り替えても価格は変わりません。 |
最初の表には、このページの Wan 3.0 Image to Video ツールによって公開されるコントロールがリストされています。
| パラメータ | 必須 | タイプ | デフォルト | 範囲/オプション | 選び方 |
|---|---|---|---|---|---|
プロンプト* | はい (*) | 文字列 | プロンプトの例 | 最大 20,000 文字 | 被写体、その動き、カメラの動き、照明、スタイルを説明します。明確な構造は長さよりも重要です。 |
image_url* | はい (*) | 文字列 | サンプル画像 | 画像 URL または Base64 | 最初のフレーム Wan 3.0 からアニメーション化されます。被写体を最大限に保存するには、鮮明で明るい、整然とした画像を使用してください。 |
end_image_url | いいえ | 文字列 | 空 | 画像 URL または Base64 | オプションの最後のフレーム。エンディングのポーズや構図が決まったときに設定します。 |
解像度 | いいえ | 文字列 | 720p | 480p、720p、1080p | 簡単なドラフトには 480p を使用し、より詳細な配信には 1080p を使用します。 |
aspect_ratio | いいえ | 文字列 | adaptive | adaptive、16:9、9:16、1:1、4:3、3:4 | `adaptive' のままにして入力画像に従うか、特定の配置の比率を強制します。 |
期間 | いいえ | 整数 | 5 | 2–30 秒 | モーションを調整する間は短く保ち、方向を確認したら上げます。 |
thinking_mode | いいえ | ブール値 | 偽 | true / false | 複数の動きや構成ルールを組み合わせた複雑なプロンプトを有効にします。 |
enable_audio | いいえ | ブール値 | 本当 | true / false | 同期されたオーディオトラックを聴き続けます。無音クリップの場合はオフにします。 |
シード | いいえ | 整数 | ランダム | 0–2147483647 | シードを修正して、比較可能な小さな編集を行うときに結果を再現します。 |
次の表は、より広範な Wan 3.0 モデルをまとめたものです。参照、ドキュメント、およびテキストのみの入力は、この画像からビデオへのページのコントロールとしてではなく、モデルの他のモードおよび兄弟ツールを通じて使用できます。
| コア寸法 | Wan 3.0 |
|---|---|
| モデル | wan3.0-video |
| 生成モード | テキストからビデオへ。 Image-to-Video (最初のフレーム、または最初と最後のフレーム)。画像、ビデオ、オーディオからのビデオへの参照。加えて、ドキュメントと Web リンクの参照も含まれます。 |
| 出力期間 | 2 ~ 30 秒。ビデオ入力の場合、入力と出力は 30 秒以内に留まります。スマート持続時間オプションを使用すると、Wan 3.0 で長さを推奨できます。 |
| 解決策 | 480P、720P、または 1080P。 |
| 出力アスペクト比 | adaptive (入力から推奨) または 16:9、4:3、1:1、3:4、9:16。 |
| 音声を出力 | オプションの同期オーディオ。画像とともに生成され、デフォルトでオンになります。 |
| 最初/最後のフレーム入力 | first_frame と last_frame は 1 つまで。画像: JPEG、JPG、PNG、BMP、または WEBP。片面あたり「240 ~ 8000」ピクセル。アスペクト比は最大「8:1」。それぞれ最大 20 MB。 |
| 参考画像 | 被写体、物体、シーンの一貫性を保つための最大 10 枚の参照画像。 |
| 参考ビデオ | 最大 5 つのクリップ。 MP4 または MOV;それぞれ「1 ~ 15」秒。ビデオを組み合わせて最大 15 秒まで。片側あたり「240 ~ 4096」ピクセル。クリップごとに最大 100 MB。 |
| 参考音声 | 最大 5 つのクリップ。 WAV または MP3;合計 15 秒までの音声。それぞれ最大 15 MB。 |
| ドキュメント / Web 入力 | 1 つのドキュメント (DOCX、PDF、PPTX、XLSX、TXT など、最大 50 ページ) または 1 つのパブリック Web リンク。 |
| モードの独占性 | 最初/最後のフレームの入力を、同じリクエスト内の参照、ドキュメント、またはリンクの入力と組み合わせることはできません。 |
| プロンプト制限 | 最大 20,000 文字。 |
Wan 3.0 の価格は、選択した解像度と生成される期間によって異なります。 Wan 3.0 オーディオを有効または無効にしても、レートは変わりません。
| 解像度 | 1 秒あたりの料金 | 5秒 | 10代 | 30代 |
|---|---|---|---|---|
| 480p | $0.06 | $0.30 | $0.60 | $1.80 |
| 720p | $0.12 | $0.60 | $1.20 | $3.60 |
| 1080p | $0.25 | $1.25 | $2.50 | $7.50 |
1 ~ 4 個の出力のバッチの場合、合計を「期間 × 1 秒あたりのレート × 出力数」として計算します。
この再利用可能な Wan 3.0 構造を使用します。
[主題 + 詳細の定義] + [時間にわたる 1 つのモーション] + [カメラのフレーミングと動き] + [設定 + 照明] + [視覚的処理] + [音声] + [終了フレームまたは制約]
この Wan 3.0 の比較をモデルファミリーのガイドとして使用してください。最大解像度と継続時間は同時に利用できない場合があり、ツールが異なれば、異なる入力やコントロールが公開される可能性があります。公開されている情報に基づいています。
| モデル | 解像度 | 最大持続時間 | オーディオ | 目立つ |
|---|---|---|---|---|
| Wan 3.0 | 480p–1080p | 30代 | オプションの同期オーディオ | テキスト、最初/最後のフレーム、画像、ビデオ、オーディオからのビデオへの参照に加え、ドキュメントと Web 入力を網羅する 1 つのオールインワン モデル。 |
| クリング3.0 | 最大4K | 15秒 | リップシンク付きネイティブオーディオ | スクリプト化された広告やキャラクター シーンのマルチショット カメラの変更やスピーカー割り当てのダイアログを調整します。 |
| 海洛02 | 1080p | ~10代 | なし | 物理に焦点を当てたモーションと、サイレントアクションと製品ショットに対する強力な即時準拠。 |
| シーダンス 2.5 | 1080p | 30代 | 共同オーディオとビデオ | 同期された音声とエフェクトを使用したリファレンスを多用した生成により、アイデンティティに敏感な編集が可能です。 |
| ヴェオ3.1 | 4K | 8秒 | ネイティブのダイアログとエフェクト | 映画のようなトランジションや組み立てられたシーケンスに適した最初/最後のフレームとリファレンス コントロール。 |
Wan 3.0 の特徴はその幅の広さです。最初のフレームをアニメーション化し、最後のフレームを尊重し、画像、ビデオ、オーディオ、ドキュメント、リンクから取得できる単一のモデルで、オプションの同期サウンドも生成できます。生命を吹き込む開始フレームがある場合は Wan 3.0 Image to Video を選択し、開始点が変更された場合はテキスト ツールまたは参照ツールに移動します。
開始静止画と終了静止画を滑らかな映画のようなビデオにブリッジします
画像から映画のような高品質動画を生成。直感操作で創造力を広げるFusionX。
480p/768p およびネイティブ ステレオ オーディオによるオープンウェイトのテキストからビデオへの変換。
参照動画から新しいショットを生成し、プロンプト、要素、画像、アスペクト比、長さ、元の音声で結果を調整できます。
Fast版で動画背景を除去し、コーデック、輪郭調整、被写体タイプを設定できます。
AIが画像を滑らかに動画化。Wan 2.2で創造性あふれる映像制作をスマートに実現。
Wan 3.0 image-to-video は、単一の最初のフレーム画像を取得し、テキスト プロンプトに基づいてそれを短く一貫したクリップにアニメーション化します。リギングや手動キーフレームを使用せずに、製品ショット、ポートレート、ライフスタイル写真、またはコンセプト アートをモーションに変換するのに適しています。
常に最初のフレームの画像を指定します。最後のポーズや構図が重要な場合は、オプションで最後のフレームの画像を追加できます。 Wan 3.0 は、最初のフレームから開始して最後のフレームに向かって解決する連続モーションを生成し、ショットの開始と終了をより厳密に制御できるようにします。
最初のフレームはビデオの冒頭として直接使用されるため、Wan 3.0 はクリップ全体を通じて被写体の外観とフレーミングの一貫性を保つ傾向があります。鮮明で明るい、整然とした入力画像を使用すると、被写体を最大限に保存できます。
Wan 3.0 は、480p、720p、および 1080p 出力をサポートしており、720p が共通のデフォルトとして使用されます。期間は 2 ~ 30 秒の範囲で調整でき、アスペクト比はワイドスクリーン、垂直、正方形、またはクラシックにすることも、入力画像に従うように adaptive に設定することもできます。正確な電流制限については、RunComfy パラメータ パネルを確認してください。
はい。 Wan 3.0 は、クリップとともに同期されたオーディオ トラックを生成でき、サイレント映像のみが必要な場合はオーディオをオフにすることができます。オーディオを切り替えても生成コストは変わりません。
入力画像は、適切な解像度とアスペクト比を備えた、JPEG、PNG、WEBP などの一般的な形式である必要があります。非常に低品質のフレームや非常に乱雑なフレームはモーションの品質を低下させる可能性があるため、クリーンで高解像度の最初のフレームを推奨します。制限はプロバイダーの設定によって異なる場合があります。
はい。 RunComfy モデル UI で Wan 3.0 のプロトタイプを作成し、本番または自動化のために同じパラメーターを使用して RunComfy HTTP API を介して同じモデルを呼び出すことができます。これにより、モデルを変更せずに、ブラウザー テストから統合パイプラインに移行できます。
生成では、出力解像度と期間に基づいて米ドルまたはクレジットが消費されます。480p では 1 秒あたり 0.06 ドル、720p では 1 秒あたり 0.12 ドル、1080p では 1 秒あたり 0.25 ドルです。通常、新規ユーザーは、大規模な実行にコミットする前に Wan 3.0 を試すための無料トライアル期間を取得します。
RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。





