根據文字、參考音訊或圖片產生自然的語音與音訊。
Kling Avatar V2 透過兩項必填媒體輸入產生口播數字人影片:人像決定畫面中的人物,音訊驅動說話表現。你還可以填寫可選提示詞,對錶情、頭部動作或表達方式作簡短補充。
這個 RunComfy 頁面只提供 image、audio 和 prompt 三個輸入欄位,沒有單獨的影片時長、長寬比或解析度設定。
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| image | string (image_uri) | 必填 | 用於建立數字人的人像 URL。 |
| audio | string (audio_uri) | 必填 | 用於驅動數字人說話表現的音訊 URL。 |
| prompt | string | 選填; 預設: 空白; 最多 2500 個字元 | 對動作、表情或表達方式的簡短說明。 |
prompt 應簡短明確,只描述需要影響的行為,例如“語氣沉穩”或“輕微點頭”。建議先在 RunComfy 模型介面中共同檢查人像、音訊和可選提示詞。接入應用程式時,可透過 Kling Avatar V2 API 端點 提交相同的三個欄位。
正式使用前,請查看目前的模型供應商與 RunComfy 條款,並確認你對人像、音訊、提示詞及產生影片擁有必要權利。
如需其他服務版本,可查看 Kling AI Avatar V2 Pro 模型。
每秒 $0.055。
根據文字、參考音訊或圖片產生自然的語音與音訊。
使用提示詞編輯參考影片,可加入元素與圖片參考,並可選擇保留原始音軌。
Seedance 2.5 Reference to Video 4K:多參考 4K 剪輯
根據參考素材生成 3–15 秒影片,起價為每秒 $0.084。
使用 1–6 張圖像組合場景,並透過 Pikascenes 將其製作成動態影片。
為單張圖片套用所選的 Pikaffect 特效,並將結果生成影片。
是否可以商用取決於目前的模型供應商與 RunComfy 條款,以及你對人像、音訊、提示詞和產生結果所擁有的權利。透過 RunComfy 使用模型並不會取代這些條款,也不會自動授予第三方素材的使用權。發布或變現前,請先核對適用條款。
頁面要求提供一個 image URL 和一個 audio URL。prompt 為選填項目,最多 2500 個字元。本頁面沒有獨立的時長、長寬比、解析度或多參考圖輸入。
先在 RunComfy 模型介面中測試必填的 image、audio 以及可選的 prompt,再透過模型的 HTTP API 提交相同欄位。請確保媒體 URL 在整個處理期間可存取,並在應用程式中妥善處理任務狀態、失敗情況和傳回結果。
這個頁面面向音訊驅動的口播數字人工作流:一張人像確定出鏡人物,一段音訊驅動說話表現,可選提示詞用於補充行為要求。它不是多圖編輯工具,也不是純文字產生影片的介面。
本頁面沒有承諾固定的免費試用額度。積分、價格和帳號資格可能變化,開始正式任務前請以 RunComfy 帳號中顯示的最新資訊為準。
schema 只明確 image 使用 image_uri、audio 使用 audio_uri,並未逐一列出所有相容副檔名。請使用目前介面接受的格式並提供可直接存取的 URL;如果檔案被拒絕,可轉換為常見的網頁圖片或音訊格式後重試。
如對請求、積分或 API 接入有疑問,可傳送電子郵件至 hi@runcomfy.com 聯絡 RunComfy。請附上相關任務 ID 和簡要問題說明,但不要透過電子郵件傳送私密素材或登入憑證。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。