将起始静帧动画化为可选原生音频的短视频
video_url、text 和 voice_id 为必填项。.mp4 或 .mov,文件不超过 100 MB,时长为 2–10 秒。支持 720p 或 1080p,宽度和高度为 720–1920 像素。text 最多 120 个字符。voice_id 提供 27 个固定值,默认为 genshin_vindi2。voice_language 支持 zh 和 en,默认为 en。voice_speed 范围为 0.8–2,默认值为 1。genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1
选择音色 ID 和对应语言,将文本控制在 120 个字符以内,并根据视频时长调整语速。建议使用简短、断句清晰的句子。请检查句子开头、停顿、快速音节和头部运动。
此版本没有上传自定义音频文件的字段。
将起始静帧动画化为可选原生音频的短视频
通过提示引导的动作和原生音频继续播放现有视频。
使用一段音频和一张图片生成视频,并可按需设置提示词和随机种子。
智能将静态图像转换为动态视频,轻松生成高清创意内容,助力设计与营销表达。
高效AI文本转视频工具,轻松将创意脚本变为生动影片,助力设计师快速呈现视觉故事。
使用必填音频驱动一段短视频,并控制情绪、编辑范围、音视频时长不一致时的处理方式和表现力。
它会根据文本生成语音,并与现有视频同步。
video_url、text 和 voice_id 为必填项。
视频必须为 .mp4 或 .mov,不超过 100 MB,时长 2–10 秒,分辨率为 720p 或 1080p,宽度和高度为 720–1920 像素。
text 最多 120 个字符。
genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1
默认值为 genshin_vindi2。
voice_language 支持 zh 和 en,默认为 en。
voice_speed 范围为 0.8–2,默认值为 1。
不可以。此版本没有音频 URL 字段。
使用简短、断句清晰的句子,并选择适合视频时长的语速。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





