プロンプトから動画を生成し、LoRA、解像度、アスペクト比、フレーム数、FPS、ステップ数、シードを設定します。
| パラメータ | 型 | デフォルト/範囲 | 説明 |
|---|---|---|---|
| image | string (image_uri) | 必須入力 | 参考キャラクター画像のURL。 |
| video | string (video_uri) | 必須入力 | モーションを提供する運転動画の URL。 |
| prompt | string | 任意 | スタイル、外観、またはシーンのマイナーな詳細についてのテキスト ガイダンス。 |
| resolution | string | 480p / 720p | 出力解像度。 480p がデフォルトです。 |
| seed | integer | 指定なし | 生成結果を変化させたり再現したりするためのシードです。 |
現在のページでは、num_inference_steps、ControlNet、または IP-Adapter の設定が公開されていません。
・キャラクターの顔、体、シルエットがわかりやすい参考画像を使用してください。
SCAIL は、モデル インターフェースで公開されている同じコントロール (image、video、prompt、resolution、および seed) を使用して、RunComfy API を通じて呼び出すことができます。
プロンプトから動画を生成し、LoRA、解像度、アスペクト比、フレーム数、FPS、ステップ数、シードを設定します。
Wan 3.0 Reference To Video は画像、ビデオ、オーディオ参照からクリップを構築します
Pikadditionsで画像内の人物や物体を既存の動画に追加します。
1枚の画像から映画的な4K動画を生成。出力1秒あたり$0.47。
参照画像をもとに、滑らかな720Pまたは1080P動画を1つのプロンプトで生成します。
開始画像を文章で動かし、画面比率、解像度、長さ、スタイル、音声、複数クリップを設定できます。
SCAIL は、Tsinghua University と Z.ai に関連付けられたキャラクター アニメーション モデルです。 1 つの参照キャラクター画像と運転動画を使用するため、キャラクターは画像から、モーションは動画から得られます。一般的なテキストから動画へのワークフローでは、主に書面によるプロンプトから新しいシーンを作成します。
SCAIL は、写真だけでなく、イラスト、漫画、アニメ スタイルのリファレンスでも使用できます。明確なシルエットと目に見える顔と体の特徴により、ソース キャラクターを認識し続けながら、モデルが運転モーションに追従するのに役立ちます。
現在の RunComfy インターフェースは 480p と 720p を提供しており、480p がデフォルトです。ページ スキーマでは、再生時間の制御やクリップの最大長の公開は行われないため、使用する予定の動画の現在のアップロード要件と API 要件を確認してください。
公開されたワークフローでは、1 つの参照画像、1 つの運転動画、オプションのテキスト プロンプトに加えて、resolution と seed が使用されます。このページでは、ControlNet または IP-Adapter の入力は公開されておらず、そのスキーマにはプロンプト トークンの制限が記載されていません。
RunComfy モデル インターフェースで参照画像と走行動画を検証し、対応する image、video、prompt、resolution、および seed フィールドを使用して SCAIL エンドポイントを呼び出します。実稼働ワークフローに認証、ポーリング、再試行、出力検証を追加します。
公開されたワークフローでは、ユーザーがフレームごとにポーズ スケルトンをアップロードする必要はありません。代わりに、参照イメージがキャラクターを定義し、運転動画が動きを提供するため、最初のアニメーション パスに必要な手動セットアップの量が削減されます。
SCAIL は、既存のキャラクター画像にモーションを転送することに特化しています。新しいシーンを作成することが目的の場合は、一般的なテキストから動画へのモデルまたは画像から動画へのモデルの方が適している可能性があります。特定のキャラクターと特定の運転モーションを組み合わせる必要がある場合は、SCAIL がより直接的に適合します。
ソースページにはライセンスが明記されていないため、商用許可があるとみなすべきではありません。商用プロジェクトで出力を使用する前に、現在の公式リポジトリとモデル ライセンス、および適用される RunComfy の規約を確認してください。
フレームごとのポーズ ファイルは入力として公開されません。画像と運転動画から初期結果を生成できますが、手、遮蔽物、速い動き、またはアイデンティティの詳細が重要な場合、制作作業でレビューやポストプロダクションが必要になる場合があります。
キャラクターを明確に示す鮮明な参考画像と、動きが読み取れる走行動画から始めます。同様のフレーミングと体のプロポーションにより転送が容易になりますが、重度のオクルージョン、混雑したシーン、または突然のカメラの動きには追加のテストが必要です。
RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。


