依圖片與提示詞生成 5 秒或 8 秒的 480p 或 720p 影片。
Kling Avatar V2 透過兩項必填媒體輸入產生口播數字人影片:人像決定畫面中的人物,音訊驅動說話表現。你還可以填寫可選提示詞,對錶情、頭部動作或表達方式作簡短補充。
這個 RunComfy 頁面只提供 image、audio 和 prompt 三個輸入欄位,沒有單獨的影片時長、長寬比或解析度設定。
| 參數 | 類型 | 預設值/範圍 | 說明 |
|---|---|---|---|
| image | string (image_uri) | 必填 | 用於建立數字人的人像 URL。 |
| audio | string (audio_uri) | 必填 | 用於驅動數字人說話表現的音訊 URL。 |
| prompt | string | 選填; 預設: 空白; 最多 2500 個字元 | 對動作、表情或表達方式的簡短說明。 |
prompt 應簡短明確,只描述需要影響的行為,例如“語氣沉穩”或“輕微點頭”。建議先在 RunComfy 模型介面中共同檢查人像、音訊和可選提示詞。接入應用程式時,可透過 Kling Avatar V2 API 端點 提交相同的三個欄位。
正式使用前,請查看目前的模型供應商與 RunComfy 條款,並確認你對人像、音訊、提示詞及產生影片擁有必要權利。
如需其他服務版本,可查看 Kling AI Avatar V2 Pro 模型。
依圖片與提示詞生成 5 秒或 8 秒的 480p 或 720p 影片。
將起始靜幀動畫化為可選原生音訊的短影片
透過 AI 轉換既有影片,同時維持動作穩定與設計一致。
根據文字提示詞和 1~3 段參考影片生成影片,並可設定時長、輸出尺寸、鏡頭結構、隨機種子、反向提示詞和音訊生成。
使用 Fast 版本移除影片背景,並設定輸出編碼、前景邊緣細化與主體類型。
以 Veo 3.1 將文字轉化為電影級影片,結合精準控制與真實音效,激發創意靈感。
是否可以商用取決於目前的模型供應商與 RunComfy 條款,以及你對人像、音訊、提示詞和產生結果所擁有的權利。透過 RunComfy 使用模型並不會取代這些條款,也不會自動授予第三方素材的使用權。發布或變現前,請先核對適用條款。
頁面要求提供一個 image URL 和一個 audio URL。prompt 為選填項目,最多 2500 個字元。本頁面沒有獨立的時長、長寬比、解析度或多參考圖輸入。
先在 RunComfy 模型介面中測試必填的 image、audio 以及可選的 prompt,再透過模型的 HTTP API 提交相同欄位。請確保媒體 URL 在整個處理期間可存取,並在應用程式中妥善處理任務狀態、失敗情況和傳回結果。
這個頁面面向音訊驅動的口播數字人工作流:一張人像確定出鏡人物,一段音訊驅動說話表現,可選提示詞用於補充行為要求。它不是多圖編輯工具,也不是純文字產生影片的介面。
本頁面沒有承諾固定的免費試用額度。積分、價格和帳號資格可能變化,開始正式任務前請以 RunComfy 帳號中顯示的最新資訊為準。
schema 只明確 image 使用 image_uri、audio 使用 audio_uri,並未逐一列出所有相容副檔名。請使用目前介面接受的格式並提供可直接存取的 URL;如果檔案被拒絕,可轉換為常見的網頁圖片或音訊格式後重試。
如對請求、積分或 API 接入有疑問,可傳送電子郵件至 hi@runcomfy.com 聯絡 RunComfy。請附上相關任務 ID 和簡要問題說明,但不要透過電子郵件傳送私密素材或登入憑證。
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。