logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

live avatar generator:製作擬真口型同步影片 | RunComfy

community/live-avatar

將一張靜態人像和一段音訊轉換成擬真的說話影片,兼具準確的口型同步、自然的臉部動作,以及方便重複製作的參數控制。

必須提供有效的圖片 URL;模型會讓圖片中的人物動起來。
0:00
0:00
必須提供有效的 WAV 或 MP3 音訊 URL;虛擬人物會依照這段音訊產生口型與動作。
每個片段約 3 秒;數值越大,產生的影片越長。
必須是 4 的倍數。數值越大,動作通常越流暢,但產生時間也越長。
數值越大,結果越嚴格遵循提示詞。
Idle
The rate is $0.01 per second.

live avatar generator 簡介

live avatar generator 可將一張靜態人像和一段 WAV 或 MP3 音訊轉換成擬真的說話影片,並呈現準確的口型同步與自然的臉部動作。你可以用精簡明確的提示詞控制表情、節奏感和動作幅度。它適合內容創作者、行銷團隊、教育工作者與開發者,可大幅簡化拍攝和動畫製作流程。在 RunComfy 中,你既可直接透過瀏覽器使用,也能透過 HTTP API 整合,無須自行部署或擴充模型。

適用情境:AI 代言人影片 | 線上課程旁白 | 互動式虛擬角色

live avatar generator 的核心優勢#

live avatar generator 專為「以音訊驅動單張人像」而設計。它會在保留人物身分特徵、臉部結構和畫面構圖的同時,產生連貫的說話影片。準確的口型同步、自然的微表情和穩定動作,使其適合以不同聲音和呈現風格進行批次製作。


主要功能:

  • 結構保持:在連續畫面中維持人物身分、姿勢和臉部關鍵特徵。
  • 口型同步:讓嘴形變化準確貼合輸入音訊的節奏。
  • 自然表情:加入眨眼、輕微點頭和視線變化,並盡量減少漂移。
  • 流暢輸出:frames_per_clip 必須是 4 的倍數;提高此值通常能讓動作更流暢,但也會延長產生時間。
  • 製作控制:num_clips 控制片長,guidance_scale 控制提示詞遵循程度,seed 有助於重現相近結果。
  • 輸入彈性:支援不同裁切方式的人像,以及 WAV 或 MP3 音訊。

live avatar generator 提示詞指南#

先透過 image_url 提供人物圖片,再透過 audio_url 提供 WAV 或 MP3 音訊,接著用精煉的提示詞說明期望的表情、節奏和動作範圍。每增加一個 num_clips,片長約增加 3 秒;frames_per_clip 控制動作流暢度,而且必須是 4 的倍數。如果結果需要更嚴格遵循提示詞,可適度提高 guidance_scale;重複使用 seed 有助於獲得可重現的結果。為了讓視線和臉部結構更穩定,建議使用清晰、正面、臉部置中的人像,並保持背景簡潔。


範例:

  • "Preserve identity and camera framing; neutral studio lighting; subtle head nods and natural blinks; align to audio."
  • "Keep background unchanged; focus motion on mouth and eyes; no head rotation; live avatar generator follows the audio pace."
  • "Confident, upbeat delivery; small smiles on emphasized words; keep gaze at camera; avoid shoulder movement."
  • "Serious tone; minimal facial movement; maintain lip precision; increase frames_per_clip to 64 for smoother motion."
  • "Editorial look; soft key light from left; micro-expressions only; live avatar generator keeps structure and pose intact."

實用建議:

  • 清楚寫出哪些內容必須維持不變、哪些部分可以移動。
  • 使用「左側」「右側」或「僅背景」等空間描述來限定動作區域。
  • 使用清晰的高解析度人像,並裁掉無關的干擾元素。
  • 與其塞入大量要求,不如保留少數關鍵描述,再逐步調整 guidance_scale。
  • 先確定 num_clips 和 frames_per_clip,再微調風格與 seed。

相關模型

seedance-2.5/text-to-video/720p

Seedance 2.5:一致性更強、支援更長片段的電影級 AI 影片

sora-2/image-to-video

將靜態圖片轉化為細膩動態影片,享受真實音畫同步的創作體驗。

kling-video-o1/image-to-video/reference

透過必填參考圖片與元素陣列生成影片,使用按順序編號的 @Image 和 @Element 標記,並精確控制片長與長寬比。

happyhorse-1.1/reference-to-video

只要一段提示詞,即可根據參考圖生成流暢的 720P 或 1080P 影片。

kling-2-1/master/image-to-video

以 Kling 2.1 將靜態圖片與文字提示轉化為高畫質動態影片,展現真實立體運動效果。

sora-2/pro/image-to-video

使用 Sora 2 Pro 依提示詞讓參考圖動起來,並選擇輸出尺寸與時長。

常見問題

live avatar generator 是什麼?它如何將圖片轉成影片?

live avatar generator 會結合一張靜態人像、一段 WAV 或 MP3 音訊和提示詞進行生成。它讓人物臉部動作與音訊內容同步,同時由提示詞控制表情、節奏和動作幅度。

哪些人最適合使用 live avatar generator?

它適合需要快速製作說話人物影片的創作者、教育工作者、行銷人員和產品團隊,常見用途包括 AI 代言人、課程講解、產品說明和客服虛擬角色。

live avatar generator 可以免費使用嗎?

RunComfy 會依生成任務扣除點數。帳戶是否有試用額度,以及目前參數所需的點數,都會顯示在 RunComfy 介面中,你可以在執行模型前確認。

live avatar generator 提供哪些控制參數?

num_clips 以約 3 秒一個片段控制大致片長;frames_per_clip 控制動作流暢度且必須是 4 的倍數;guidance_scale 調整提示詞遵循程度;seed 用於重現相近結果。

live avatar generator 接受哪些輸入?

此端點必須提供有效的 image_url、指向 WAV 或 MP3 音訊的有效 audio_url,以及提示詞。它會回傳說話人物影片;輸出解析度由服務決定,並未開放為輸入參數。

一次生成可以製作多個虛擬角色的對話嗎?

此端點一次只處理一張人像和一段音訊。若要製作多人對話,請分別為每位說話者產生片段,再使用剪輯工具組合。

如何提高生成品質?

使用清晰、正面、臉部置中的人像與簡潔背景,提供乾淨的音訊,並用精煉的提示詞描述表情與動作。建議逐步調整 guidance_scale,不要在單一提示詞中塞入過多要求。

live avatar generator 有哪些主要限制?

它較適合臉部動畫和說話人像,不適合強調全身動作或大量手勢的場景。較長影片也更容易出現漂移;清晰的輸入素材和合理的片段設定通常能帶來更穩定的結果。

可以在哪裡使用 live avatar generator?

你可以直接在 RunComfy 瀏覽器介面中執行,也能透過 HTTP API 整合。生成任務在雲端執行,無須在本機安裝或託管模型。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

live avatar generator 效果範例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...