logo
RunComfy
  • ComfyUI
  • トレーナー新着
  • モデル
  • API
  • 価格
discord logo
モデル
探索
すべてのモデル
ライブラリ
生成履歴
モデルAPI
APIドキュメント
APIキー
アカウント
使用量

Wan 3.0 Reference To Video: Models and API でのマルチモーダル リファレンス ビデオの生成 | RunComfy

wan-ai/wan-3.0/reference-to-video

Wan 3.0 Reference To Video は、プロンプトと画像、ビデオ、オーディオのリファレンスを組み合わせて、一貫した主題、モーション、サウンドを含む一貫したクリップを作成します。

シーン、被写体、モーション、カメラの動き、照明、スタイルを説明します。画像 1、ビデオ 1、音声 1 の順に参考資料を参照してください。
Image 1
被写体、物体、シーンの一貫性を保つための最大 10 枚の参照画像。少なくとも 1 つの参照 (画像、ビデオ、またはオーディオ) が必要です。
モーションまたはシーンのガイダンス用に、最大 5 つのリファレンス ビデオ (MP4 または MOV、それぞれ 1 ~ 15 秒、合計 15 秒以内)。
サウンドやタイミングをガイドするための最大 5 つのリファレンス オーディオ クリップ (合計 15 秒以内)。
出力解像度層。素早いドラフトには 480p を使用し、高品質の出力には 1080p を使用します。
生成されたビデオの出力アスペクト比。
生成されたビデオの長さ (秒単位)。範囲は 2 ~ 30 です。反復するには短く始めて、モーションが正しく見えるようになったら増やします。
複数の動きや構成要件がある複雑なシーンに対して、より深いプロンプト解釈を可能にします。
オンの場合、出力ビデオには同期されたオーディオ トラックが含まれます。無音クリップの場合はオフにします。
再現可能な結果のためのランダムシード。範囲は 0 ~ 2147483647 です。
Idle
The rate is $0.06 per second for 480p, $0.12 per second for 720p, and $0.25 per second for 1080p.

Wan 3.0 Reference To Video の紹介

Wan 3.0 Reference To Video は、プロンプトに加えて、画像、ビデオ、オーディオなどのマルチモーダルな参照から一貫したクリップを組み立てます。長さは 2 ~ 30 秒で、アスペクト比を制御できます。脆弱な合成をリファレンスに基づいた一貫性と引き換えに、スタジオ、広告チーム、クリエイターがショット全体でキャラクター、オブジェクト、モーション、サウンドをブランドに沿った状態に保つのに役立ちます。開発者にとって、RunComfy の Wan 3.0 Reference To Video はブラウザーと HTTP API の両方で使用できるため、モデルを自分でホストしたりスケールしたりする必要はありません。
理想的な用途: 文字の一貫性 |ブランド製品のシーン |マルチモーダルなストーリーテリング

Wan-AI / Wan 3.0 Reference To Video#


Wan 3.0 Reference To Video は、テキスト プロンプトと参照メディアを取得し、それらを尊重する新しいクリップを作成します。参照画像、ビデオ、またはオーディオを指定し、プロンプトでそれらを画像 1、ビデオ 1、またはオーディオ 1 として指定して、誰が表示されるか、どのように動くか、シーンのサウンドがどのように聞こえるかを制御します。


この参照エンドポイントは、繰り返し登場するキャラクター、特定の製品、クリップから取得したモーション スタイル、または新しいショットに持ち込まれるオーディオ フィールなど、一貫性のある作業のために構築されています。参照は、指定した順序で照合されます。


ハイライト#


  • マルチモーダル リファレンス: 最大 10 個の画像、5 個のビデオ、5 個のオーディオ クリップを使用してショットをガイドします。
  • 主題の一貫性: クリップ全体でキャラクター、製品、またはオブジェクトを認識できるようにします。
  • モーションとタイミングのキュー: リファレンスビデオから動きやペースを借用します。
  • オーディオ ガイダンス: リファレンス オーディオを使用して、結果のサウンドとリズムを調整します。
  • 柔軟な出力: 2 ~ 30 秒を設定し、最終的な配置のアスペクト比を選択します。

パラメータ#


パラメータ必須タイプデフォルト範囲/オプション説明
プロンプト*はい (*)文字列--シーン、被写体、モーション、カメラ、照明、スタイル。
reference_images条件付き配列空最大 10被写体やシーンの一貫性を保つための参考画像。
reference_videos条件付き配列空最大 5参考ビデオ (各 1 ~ 15 秒、合計 15 秒)。
reference_audios条件付き配列空最大 5参考音声 (合計 15 秒)。
解像度いいえ文字列720p480p、720p、1080p出力解像度層。
aspect_ratioいいえ文字列16:916:9、9:16、1:1、4:3、3:4、adaptive出力アスペクト比。
期間いいえ整数52-30秒単位の出力長。
thinking_modeいいえブール値偽真 / 偽複雑なプロンプトのより深い解釈。
enable_audioいいえブール値本当真 / 偽同期されたオーディオ トラックを含めます。
種子いいえ整数ランダム0-2147483647再現可能な結果のシード。

reference_images、reference_videos、または reference_audios の少なくとも 1 つを指定します。


価格設定#


価格は選択した解像度によって異なります。480p では 1 秒あたり 0.06 ドル、720p では 1 秒あたり 0.12 ドル、1080p では 1 秒あたり 0.25 ドルです。オーディオを有効または無効にしてもレートは変わりません。

関連モデル

flux-3/text-to-video/draft

FLUX 3 Draft: 720p での高速かつ低コストのテキストからビデオへのプレビュー

kling-2-5/turbo/text-to-video

Kling 2.5 Turboでプロンプトから動画を生成し、長さ、アスペクト比、ネガティブプロンプトを設定します。

seedance-2.5/first-last-frame/480p

Seedance 2.5 FLF2V 480p: 低コストでの最初から最後のフレームのドラフト移行

dreamina-3-0/image-to-video

静止画を滑らかな映像に変換。Dreamina 3.0が2K品質のリアリズムで創作を実現。

kling-video-o1/image-to-video/reference

必須の参照画像と要素定義から動画を生成します。配列順に対応する @Image/@Element トークンを使い、長さとアスペクト比を正確に指定できます。

pikadditions

Pikadditionsで画像内の人物や物体を既存の動画に追加します。

よくある質問

Wan 3.0 Reference To Video は何に使用されますか?

Wan 3.0 Reference To Video は、画像、ビデオ、オーディオなどの参照メディアと組み合わせたテキスト プロンプトからクリップを作成します。これは一貫性のある作業を目的として設計されており、手動で合成するのではなく、新しいショット全体でキャラクター、製品、またはモーション スタイルを認識できる状態に保ちます。

Wan 3.0 Reference To Video はどのような種類の参照を受け入れることができますか?

1 回のリクエストで最大 10 個の参照画像、最大 5 個の参照ビデオ、および最大 5 個の参照オーディオ クリップを受け入れます。画像はアイデンティティをロックするのに役立ち、ビデオはモーションやペースをガイドし、オーディオはサウンドを制御します。プロンプトでそれぞれを画像 1、ビデオ 1、またはオーディオ 1 として指定します。

Wan 3.0 Reference To Video はどのようにして主題の一貫性を保っているのでしょうか?

直接の視覚参照を提供するため、Wan 3.0 Reference To Video は、プロンプトのみを使用する場合よりも、キャラクターまたはオブジェクトの外観を生成されたシーンに確実に反映できます。一般に、クリーンな単一被写体の参照画像は、最も強力なアイデンティティ ロックを提供します。

参考ビデオとオーディオの制限は何ですか?

参照ビデオは MP4 または MOV で、それぞれ 1 ~ 15 秒、参照ビデオの合計時間は 15 秒以内である必要があります。参考音声も合計約15秒以内に収まります。実行前に、RunComfy パラメータ パネルで正確な電流制限を確認してください。

Wan 3.0 Reference To Video はどのような出力設定をサポートしていますか?

出力は 480p、720p、または 1080p で利用でき、長さは 2 ~ 30 秒、アスペクト比は 16:9、9:16、1:1、4:3、3:4 などです。同期されたオーディオ トラックを生成したり、クリップをサイレントでエクスポートしたりすることもできます。

画像からビデオへの代わりに参照からビデオへの参照を使用する必要があるのはどのような場合ですか?

複数の参照間で一貫性が必要な場合、または画像、ビデオ、および音声ガイダンスを 1 回のショットで組み合わせて使用​​する必要がある場合は、Wan 3.0 Reference To Video を使用します。既存の 1 つの最初のフレームを単にアニメーション化したい場合は、画像からビデオへの変換を使用します。

開発者は RunComfy API を通じて Wan 3.0 Reference To Video を使用できますか?

はい。 RunComfy モデル UI で Wan 3.0 Reference To Video をプロトタイプ化し、同じパラメーターを使用して RunComfy HTTP API を介して同じモデルを呼び出すことができます。これにより、ブラウザーのテストと運用の自動化の間で、リファレンス駆動のセットアップの一貫性が保たれます。

Wan 3.0 Reference To Video の RunComfy の価格はいくらですか?

世代は解像度と期間に基づいて米ドルまたはクレジットを消費します: 480p では 1 秒あたり 0.06 ドル、720p では 1 秒あたり 0.12 ドル、1080p では 1 秒あたり 0.25 ドル。通常、新規ユーザーは、大規模な実行の前に Wan 3.0 Reference To Video を試すための無料試用期間を取得します。

フォローする
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
サポート
  • Discord
  • メール
  • システムステータス
  • アフィリエイト
ビデオモデル
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • すべてのモデルを見る →
画像モデル
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • すべてのモデルを見る →
法的情報
  • 利用規約
  • プライバシーポリシー
  • Cookieポリシー
RunComfy
著作権 2026 RunComfy. All Rights Reserved.

RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。

Wan 3.0 Reference To Video の例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...