logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

live avatar generator:创建照片级口型同步视频 | RunComfy

community/live-avatar

将一张静态人像和一段音频转化为照片级说话视频,获得准确的口型同步、自然的面部动作和便于重复制作的参数控制。

必须提供有效的图片 URL;模型会让图片中的人物动起来。
0:00
0:00
必须提供有效的 WAV 或 MP3 音频 URL;虚拟人物会根据这段音频生成口型和动作。
每个片段约 3 秒;数值越大,生成的视频越长。
必须是 4 的倍数。数值越大,动作通常越流畅,但生成时间也越长。
数值越大,结果越严格遵循提示词。
Idle
The rate is $0.01 per second.

live avatar generator 简介

live avatar generator 可将一张静态人像和一段 WAV 或 MP3 音频转化为照片级的说话视频,并实现准确的口型同步与自然的面部动作。你可以用简洁明确的提示词控制表情、语速感和动作幅度。它适合内容创作者、营销团队、教育工作者和开发者,可显著简化拍摄与动画制作流程。在 RunComfy 中,你既可以直接通过浏览器使用,也可以通过 HTTP API 集成,无需自行部署或扩缩容模型。

适用场景:AI 代言人视频 | 在线课程旁白 | 互动虚拟形象

live avatar generator 的核心优势#

live avatar generator 专为“用音频驱动单张人像”而设计。它会在保留人物身份特征、面部结构和画面构图的同时,生成连贯的说话视频。准确的口型同步、自然的微表情和稳定的动作,使其适合不同声音与呈现风格下的批量制作。


主要能力:

  • 结构保持:在连续画面中维持人物身份、姿态和面部关键特征。
  • 口型同步:让嘴形变化准确贴合输入音频的节奏。
  • 自然表情:加入眨眼、轻微点头和视线变化,并尽量减少漂移。
  • 流畅输出:frames_per_clip 必须是 4 的倍数;提高该值通常会让动作更流畅,但也会延长生成时间。
  • 制作控制:num_clips 控制时长,guidance_scale 控制提示词遵循程度,seed 便于复现相近结果。
  • 输入灵活:支持不同裁切方式的人像,以及 WAV 或 MP3 音频。

live avatar generator 提示词指南#

先通过 image_url 提供人物图片,再通过 audio_url 提供 WAV 或 MP3 音频,然后用精炼的提示词说明期望的表情、节奏和动作范围。每增加一个 num_clips,时长约增加 3 秒;frames_per_clip 控制动作流畅度,且必须是 4 的倍数。如果结果需要更严格地遵循提示词,可适当提高 guidance_scale;复用 seed 有助于获得可重复的结果。为了让视线和面部结构更稳定,建议使用清晰、正面、脸部居中的人像,并保持背景简洁。


示例:

  • "Preserve identity and camera framing; neutral studio lighting; subtle head nods and natural blinks; align to audio."
  • "Keep background unchanged; focus motion on mouth and eyes; no head rotation; live avatar generator follows the audio pace."
  • "Confident, upbeat delivery; small smiles on emphasized words; keep gaze at camera; avoid shoulder movement."
  • "Serious tone; minimal facial movement; maintain lip precision; increase frames_per_clip to 64 for smoother motion."
  • "Editorial look; soft key light from left; micro-expressions only; live avatar generator keeps structure and pose intact."

实用建议:

  • 明确写出哪些内容必须保持不变、哪些部分可以运动。
  • 使用“左侧”“右侧”或“仅背景”等空间描述来限定动作区域。
  • 使用清晰的高分辨率人像,并裁掉无关干扰元素。
  • 与其堆叠大量要求,不如保留少数关键描述,再逐步调整 guidance_scale。
  • 先确定 num_clips 和 frames_per_clip,再微调风格与 seed。

相关模型

happyhorse-1.0/image-to-video

Alibaba 上的 HappyHorse 1.0 I2V 将静态图像动画化为原生 1080p 视频,具有物理精确的运动和身份稳定的主题。

luma-ray-2/text-to-video

根据必填文本提示词生成视频。可选择六种宽高比、`540p`/`720p`/`1080p`、`5` 秒/`9` 秒,以及是否循环播放。

hailuo-02/text-to-video

使用 Hailuo 02 根据一段必填文本提示词生成 6 秒或 10 秒视频,并可选择提示词扩展。

wan-2-2/speech-to-video

根据一张图片和一段音频,生成说话、唱歌或表演视频。

wan-2-6/image-to-video

使用Wan 2.6将静态图像转换为动态同步的高清视频内容,支持灵活控制。

runway-gen-4/turbo/image-to-video

精准匹配文本提示,生成动作真实、结构连贯的视频内容

常见问题

live avatar generator 是什么?它如何把图片转成视频?

live avatar generator 会结合一张静态人像、一段 WAV 或 MP3 音频和提示词进行生成。它让人物面部动作与音频内容同步,同时由提示词控制表情、节奏和动作幅度。

哪些人最适合使用 live avatar generator?

它适合需要快速制作说话人物视频的创作者、教育工作者、营销人员和产品团队,常见用途包括 AI 代言人、课程讲解、产品说明和客户服务虚拟形象。

live avatar generator 可以免费使用吗?

RunComfy 按生成任务消耗积分。账户是否有试用额度,以及当前参数对应的积分消耗,都会显示在 RunComfy 界面中,你可以在运行模型前确认。

live avatar generator 提供哪些控制参数?

num_clips 按约 3 秒一个片段控制大致时长;frames_per_clip 控制动作流畅度且必须是 4 的倍数;guidance_scale 调整提示词遵循程度;seed 用于复现相近结果。

live avatar generator 接受哪些输入?

该接口必须提供有效的 image_url、指向 WAV 或 MP3 音频的有效 audio_url,以及提示词。它会返回说话人物视频;输出分辨率由服务决定,并没有作为输入参数开放。

一次生成可以制作多个虚拟人物的对话吗?

该接口一次只处理一张人像和一段音频。若要制作多人对话,请分别为每个说话者生成片段,再使用剪辑工具组合。

怎样提高生成质量?

使用清晰、正面、脸部居中的人像和简洁背景,提供干净的音频,并用精炼的提示词描述表情与动作。建议逐步调整 guidance_scale,不要在一个提示词里堆叠过多要求。

live avatar generator 有哪些主要限制?

它更适合面部动画和说话头像,不适合强调全身动作或大量手势的场景。较长视频也更容易出现漂移;清晰的输入素材和合理的片段设置通常能带来更稳定的结果。

可以在哪里使用 live avatar generator?

你可以在 RunComfy 浏览器界面中直接运行,也可以通过 HTTP API 集成。生成任务在云端执行,无需在本地安装或托管模型。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

live avatar generator 效果示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...