logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

React-1 嘴型同步:情緒與臉部動作控制 | RunComfy

sync/react-1

使用最長 15 秒的影片和音訊生成嘴型同步結果,並提供 6 種情緒、嘴唇/臉部/頭部範圍、5 種時長不一致處理模式和表現力調整。

輸入影片的 URL,時長不得超過 15 秒。
0:00
0:00
輸入音訊的 URL,時長不得超過 15 秒。
用於生成的情緒參數,目前只支援單一英文情緒詞。
控制模型的編輯區域和動作範圍。
音訊和影片時長不一致時的處理模式。
控制嘴型同步的表現力。
Idle
The rate is $0.16 per second.

React-1 嘴型同步簡介

React-1 根據 1 個必填來源影片 URL 和 1 個必填音訊 URL 生成嘴型同步結果,兩項輸入均不得超過 15 秒。6 個精確情緒值用於引導表演,`model_mode` 決定編輯範圍是嘴唇、臉部還是頭部;`lipsync_mode` 負責處理音訊與影片時長不一致,`temperature` 則在 0~1 之間控制表現力。

React-1 概覽#


React-1 接收必填的 video_url 和 audio_url 並生成嘴型同步結果,兩項輸入均不得超過 15 秒。你可以用 emotion 引導表演,用 model_mode 選擇編輯範圍,用 lipsync_mode 決定如何處理音訊與影片時長不一致,並透過 temperature 調整表現力。


輸入和參數#


參數必填預設值/可選值作用
video_url是範例影片 URL來源影片的公開 URL;最長 15 秒。
audio_url是範例音訊 URL驅動音訊的公開 URL;最長 15 秒。
emotion否預設 neutral精確可選值:happy、angry、sad、neutral、disgusted、surprised。只支援單一英文情緒詞。
model_mode否預設 face精確可選值:lips、face、head。設定編輯區域和動作範圍。
lipsync_mode否預設 bounce精確可選值:cut_off、loop、bounce、silence、remap。控制音訊與影片時長不一致時的處理方式。
temperature否預設 0.5;範圍 0~1控制嘴型同步的表現力。

建議流程#


  1. 選用說話者臉部清楚可見的來源影片,並準備最終驅動音訊。
  2. 在提供公開 URL 前,將兩項輸入都裁剪到 15 秒以內。
  3. 選擇 1 個精確的 emotion,並使用滿足需求的最小 model_mode 範圍。
  4. 音訊與影片長度不一致時,請有意識地選擇 lipsync_mode,再以小幅度調整 temperature。

能力邊界#


  • 目前 schema 沒有輸出解析度、長寬比、影格率、檔案格式、提示詞、隨機種子或多說話者參數。
  • 它不支援 90~120 秒輸入;兩項輸入的明確上限均為 15 秒。
  • 頁面沒有提供模型比較基準,也沒有說明底層模型架構。

API 和資源#


  • RunComfy API 入口
  • Sync React-1 資源
  • Sync Lipsync-2-Pro
  • 更多嘴型同步模型

相關模型

ai-avatar/v2/standard

使用一張人像和一段音訊產生口播數字人影片,並可透過提示詞引導動作與表達方式。

wan-2-2/vace-fun

根據必填提示詞將一張必填參考圖片製作成影片。可設定輸出尺寸、影格數、播放影格率、隨機種子、步數、引導強度和 shift。

veo-3-1/first-last-frame-to-video

以 AI 將靜態圖像轉化為動態影片,支援音效同步與場景銜接,提升創作真實感與效率

infinite-talk/image-to-video

以照片生成自然對話影片,呈現真實臉部動作與表情

runway-gen-3-alpha/turbo/image-to-video

支援高擬真動畫與風格控制,Runway Gen-3 Alpha Turbo 為設計師開啟創作新境界

kling-3.0/4k/image-to-video

將靜態圖片製作成原生 4K 電影感影片,支援首尾影格引導與同步音訊。

常見問題

React-1 是什麼?它與早期嘴型同步模型有何不同?

目前頁面將 React-1 定義為使用影片和音訊進行嘴型同步的工作流程,並提供情緒、編輯範圍、時長不一致處理方式和表現力參數。schema 沒有提供與 Lipsync-2 或 Lipsync-2-Pro 的基準資料,因此不能只憑本頁面確認相對畫質或身分保持能力。

可以用 React-1 編輯既有影片嗎?

可以。透過必填的 video_url 提供既有影片,透過必填的 audio_url 提供驅動音訊,兩項輸入均不得超過 15 秒;然後按需設定 emotion、model_mode、lipsync_mode 和 temperature。

解析度、長寬比和輸入有哪些技術限制?

schema 規定 video_url 和 audio_url 均不得超過 15 秒。它沒有輸出解析度、長寬比、影格率、輸出格式、ControlNet 或 IP-Adapter 參數,因此不能從本頁面確認 4K、1080p 或 16:9 等說法。

React-1 可以處理 90~120 秒的影片嗎?

不可以。文件明確要求 video_url 和 audio_url 均不得超過 15 秒,目前 schema 沒有更長影片模式。

如何從 RunComfy 頁面移轉到 React-1 API?

完成參數測試後,使用 RunComfy API 入口,並提交相同欄位:video_url、audio_url、emotion、model_mode、lipsync_mode 和 temperature。身分驗證、狀態輪詢、限制和計費請以最新 API 文件為準。

React-1 如何控制表演情緒?

emotion 只能選擇 happy、angry、sad、neutral、disgusted、surprised,預設值為 neutral。model_mode 設定編輯範圍,temperature 在 0~1 之間調整表現力。schema 沒有說明特定的擴散或臉部幾何演算法。

什麼樣的來源影片更適合嘴型同步?

從實際使用角度,建議選擇臉部和嘴部清楚可見的短片,並提供乾淨的最終音訊。嚴重遮擋、臉部過小或動作衝突可能增加結果檢查難度,但 schema 沒有針對這些情況公布正式畫質門檻。

React-1 與通用影片生成模型有什麼不同?

目前頁面從既有的 video_url 和驅動 audio_url 開始,再提供嘴型同步表演參數。它沒有根據文字或圖片從零生成新場景的文生影片、圖生影片欄位。

React-1 生成結果可以商用嗎?

商業使用取決於 Sync 與 RunComfy 的最新條款,以及你是否擁有來源影片和音訊的相應權利。schema 本身不授予統一的商業授權,付費或公開發布前請核對目前授權要求。

這個頁面所說的情緒驅動重演具體指什麼?

你可以從 6 個精確的 emotion 值中選擇一個,並透過 model_mode 將動作範圍設為 lips、face 或 head。lipsync_mode 處理時長不一致,temperature 調整表現力;不應據此推斷文件參數之外的更廣泛能力。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

更多範例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...