テキスト、参照音声、画像から自然な音声とオーディオを生成します。
React-1 は必須の video_url と audio_url を受け取り、リップシンク動画を作成します。どちらの入力も 15 秒以内である必要があります。 emotion で表情の方向性を指定し、model_mode で編集範囲を選択し、lipsync_mode で不一致の入力長を処理する方法を決定し、temperature で表現力を調整できます。
| パラメータ | 必須 | デフォルト / オプション | 何を制御するのか |
|---|---|---|---|
video_url | はい | 動画 URL の例 | 元動画の公開 URL。 15秒以内。 |
audio_url | はい | 音声 URL の例 | ドライビング音声の公開URL。 15秒以内。 |
emotion | いいえ | デフォルト neutral | 正確な値: happy、angry、sad、neutral、disgusted、surprised。単一単語の感情値のみがサポートされます。 |
model_mode | いいえ | デフォルト face | 正確な値: lips、face、head。編集範囲と移動範囲を設定します。 |
lipsync_mode | いいえ | デフォルト bounce | 正確な値: cut_off、loop、bounce、silence、remap。音声と動画の長さが異なる場合の処理を制御します。 |
temperature | いいえ | デフォルト 0.5; 0–1 | リップシンクの表現力をコントロールします。 |
emotion を 1 つ選択し、最も狭い適切な model_mode を選択します。lipsync_mode を選択し、temperature を少しずつ調整します。テキスト、参照音声、画像から自然な音声とオーディオを生成します。
静止画像をリアルな2K映像へ変換。精密で自然な動きをAIが自動生成。
動きとデザインの一貫性を保ちながら、AIで既存映像を変換します。
参照画像を、動きの見本となる動画に沿ってアニメーション化します。
マスクまたは範囲の説明を使って動画内の選択範囲を置き換え、必要に応じて画像やプロンプトを追加します。
FLUX 3 Draft Extend: 720p での高速低コストのクリップ継続ドラフト
このページでは、感情、編集範囲、不一致処理、表現力のコントロールを備えた動画と音声のリップシンク ワークフローとして React-1 について説明します。これには、Lipsync-2 または Lipsync-2-Pro に対するベンチマーク データが含まれていないため、相対的な品質や同一性保持の主張をスキーマだけから確認することはできません。
はい。必須の video_url を通じて既存のクリップを指定し、必須の audio_url を通じて運転トラックを指定します。どちらも 15 秒以下である必要があります。次に、必要に応じて、emotion、model_mode、lipsync_mode、および temperature を選択します。
スキーマでは、video_url と audio_url の入力がそれぞれ 15 秒に制限されています。出力解像度、アスペクト比、フレーム レート、出力形式、ControlNet、または IP アダプターの設定は公開されないため、このページでは 4K、1080p、および 16:9 の主張は確立されていません。
いいえ。文書化された video_url および audio_url の入力はそれぞれ 15 秒以下である必要があります。スキーマには、より長いシーケンスのモードが記述されていません。
設定をテストした後、RunComfy API エンドポイント を使用して、同じ文書化されたフィールド: video_url、audio_url、emotion、model_mode、lipsync_mode、および temperature) を送信します。認証、ステータスポーリング、制限、請求については、最新の API ドキュメントを参照してください。
emotion は、happy、angry、sad、neutral、disgusted、または surprised を正確に受け入れます。neutral がデフォルトです。 model_mode は編集範囲を設定し、temperature は 0 と 1 の間で表現力を調整します。このスキーマには、特定の拡散方法や顔のジオメトリ方法が記載されていません。
実際的なガイダンスとして、話している顔と口が見える短いクリップを使用し、きれいな最終的な音声を提供します。スキーマではこれらの条件に対する正式な品質しきい値が公開されていませんが、重度のオクルージョン、非常に小さな顔、または競合するモーションはレビューを難しくする可能性があります。
このページは既存の video_url から始まり、audio_url を駆動し、リップシンク パフォーマンス コントロールを公開します。新しいシーンを最初から作成するためのテキストから動画への生成フィールドやイメージから動画への生成フィールドは提供されません。
商用利用は、最新の Sync および RunComfy の規約、および元動画と音声の権利に依存します。スキーマ自体は普遍的な商用ライセンスを付与するものではありません。有料配布または一般配布する前に、現在のライセンスを確認してください。
つまり、6 つの正確な emotion 値のいずれかを選択し、モーション スコープを lips、face、または head ~ model_mode に設定できることを意味します。 lipsync_mode は長さの不一致を処理し、temperature は表現力を調整します。これらの文書化された制御を超えて、より広範なパフォーマンス機能を推測することはできません。
RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。





