logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Kling Avatar V2:音訊驅動的口播數字人影片 | RunComfy

kling/ai-avatar/v2/standard

用一張人像和一段音訊製作口播數字人影片,並可透過提示詞引導動作與表達方式。

用於建立數字人的人像 URL。
0:00
0:00
用於驅動數字人說話表現的音訊 URL。
用於引導產生影片的可選提示詞,最多 2500 個字元。
Idle
The rate is $0.0562 per second.

Kling Avatar V2 簡介

Kling Avatar V2 是一款音訊驅動的圖生影片模型,可根據一張人像製作口播數字人影片。在這個 RunComfy 頁面中,`image` 和 `audio` 為必填 URL,`prompt` 為選填項目,最多可輸入 2500 個字元,用於補充動作、表情或說話方式。本頁面沒有單獨的時長、長寬比或解析度設定。你既可以在瀏覽器中試用,也可以透過 HTTP API 接入,無需自行部署模型。

Kling Avatar V2 概覽#


Kling Avatar V2 透過兩項必填媒體輸入產生口播數字人影片:人像決定畫面中的人物,音訊驅動說話表現。你還可以填寫可選提示詞,對錶情、頭部動作或表達方式作簡短補充。


這個 RunComfy 頁面只提供 image、audio 和 prompt 三個輸入欄位,沒有單獨的影片時長、長寬比或解析度設定。


輸入參數#


參數類型預設值/範圍說明
imagestring (image_uri)必填用於建立數字人的人像 URL。
audiostring (audio_uri)必填用於驅動數字人說話表現的音訊 URL。
promptstring選填; 預設: 空白; 最多 2500 個字元對動作、表情或表達方式的簡短說明。

素材準備建議#


  • 使用面部清晰、遮擋較少的人像。
  • 提供穩定且可直接存取的媒體 URL,並確保任務處理期間連結持續有效。
  • 儘量使用人聲清楚、背景噪聲較少的音訊。
  • 可選的 prompt 應簡短明確,只描述需要影響的行為,例如“語氣沉穩”或“輕微點頭”。
  • 本頁面不能單獨選擇時長、畫幅或輸出解析度。

瀏覽器與 API 工作流#


建議先在 RunComfy 模型介面中共同檢查人像、音訊和可選提示詞。接入應用程式時,可透過 Kling Avatar V2 API 端點 提交相同的三個欄位。


正式使用前,請查看目前的模型供應商與 RunComfy 條款,並確認你對人像、音訊、提示詞及產生影片擁有必要權利。


適用場景#


  • 主播或品牌發言人短片
  • 培訓與入職影片
  • 數字人的多語言配音版本
  • 由錄音驅動的角色口播

如需其他服務版本,可查看 Kling AI Avatar V2 Pro 模型。

相關模型

hunyuan-video-v1.5/image-to-video

依圖片與提示詞生成 5 秒或 8 秒的 480p 或 720p 影片。

flux-3/image-to-video

將起始靜幀動畫化為可選原生音訊的短影片

wan-2.7/edit-video

透過 AI 轉換既有影片,同時維持動作穩定與設計一致。

wan-2-6/video-to-video

根據文字提示詞和 1~3 段參考影片生成影片,並可設定時長、輸出尺寸、鏡頭結構、隨機種子、反向提示詞和音訊生成。

video-background-removal/fast/video-to-video

使用 Fast 版本移除影片背景,並設定輸出編碼、前景邊緣細化與主體類型。

veo-3-1/text-to-video

以 Veo 3.1 將文字轉化為電影級影片,結合精準控制與真實音效,激發創意靈感。

常見問題

Kling Avatar V2 的產生結果可以商用嗎?

是否可以商用取決於目前的模型供應商與 RunComfy 條款,以及你對人像、音訊、提示詞和產生結果所擁有的權利。透過 RunComfy 使用模型並不會取代這些條款,也不會自動授予第三方素材的使用權。發布或變現前,請先核對適用條款。

這個 Kling Avatar V2 頁面有哪些輸入限制?

頁面要求提供一個 image URL 和一個 audio URL。prompt 為選填項目,最多 2500 個字元。本頁面沒有獨立的時長、長寬比、解析度或多參考圖輸入。

開發者如何從瀏覽器試用切換到 API?

先在 RunComfy 模型介面中測試必填的 image、audio 以及可選的 prompt,再透過模型的 HTTP API 提交相同欄位。請確保媒體 URL 在整個處理期間可存取,並在應用程式中妥善處理任務狀態、失敗情況和傳回結果。

Kling Avatar V2 主要用於什麼?

這個頁面面向音訊驅動的口播數字人工作流:一張人像確定出鏡人物,一段音訊驅動說話表現,可選提示詞用於補充行為要求。它不是多圖編輯工具,也不是純文字產生影片的介面。

Kling Avatar V2 一定提供免費試用嗎?

本頁面沒有承諾固定的免費試用額度。積分、價格和帳號資格可能變化,開始正式任務前請以 RunComfy 帳號中顯示的最新資訊為準。

可以使用哪些圖片和音訊格式?

schema 只明確 image 使用 image_uri、audio 使用 audio_uri,並未逐一列出所有相容副檔名。請使用目前介面接受的格式並提供可直接存取的 URL;如果檔案被拒絕,可轉換為常見的網頁圖片或音訊格式後重試。

在哪裡可以獲得 Kling Avatar V2 的 RunComfy 支援?

如對請求、積分或 API 接入有疑問,可傳送電子郵件至 hi@runcomfy.com 聯絡 RunComfy。請附上相關任務 ID 和簡要問題說明,但不要透過電子郵件傳送私密素材或登入憑證。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Kling Avatar V2 的實際應用範例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...