根据文本指令编辑源视频,同时保持场景结构与动作连贯。
video_url、text 和 voice_id 为必填项。.mp4 或 .mov,文件不超过 100 MB,时长为 2–10 秒。支持 720p 或 1080p,宽度和高度为 720–1920 像素。text 最多 120 个字符。voice_id 提供 27 个固定值,默认为 genshin_vindi2。voice_language 支持 zh 和 en,默认为 en。voice_speed 范围为 0.8–2,默认值为 1。genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1
选择音色 ID 和对应语言,将文本控制在 120 个字符以内,并根据视频时长调整语速。建议使用简短、断句清晰的句子。请检查句子开头、停顿、快速音节和头部运动。
此版本没有上传自定义音频文件的字段。
根据文本指令编辑源视频,同时保持场景结构与动作连贯。
在指定的开始帧和结束帧之间创建平滑的 V6 运动。
FLUX 3 Draft:快速、低成本的 720p 文本转视频预览
Seedance 2.5 480p:快速、低成本的静态视频动画草稿
应用一个自定义 LoRA,并通过详细的输出与采样设置生成 Wan 2.1 视频。
FLUX 3 草稿关键帧:720p 快速多关键帧视频预览
它会根据文本生成语音,并与现有视频同步。
video_url、text 和 voice_id 为必填项。
视频必须为 .mp4 或 .mov,不超过 100 MB,时长 2–10 秒,分辨率为 720p 或 1080p,宽度和高度为 720–1920 像素。
text 最多 120 个字符。
genshin_vindi2, zhinen_xuesheng, AOT, ai_shatang, genshin_klee2, genshin_kirara, ai_kaiya, oversea_male1, ai_chenjiahao_712, girlfriend_4_speech02, chat1_female_new-3, chat_0407_5-1, cartoon-boy-07, uk_boy1, cartoon-girl-01, PeppaPig_platform, ai_huangzhong_712, ai_huangyaoshi_712, ai_laoguowang_712, chengshu_jiejie, you_pingjing, calm_story1, uk_man2, laopopo_speech02, heainainai_speech02, reader_en_m-v1, commercial_lady_en_f-v1
默认值为 genshin_vindi2。
voice_language 支持 zh 和 en,默认为 en。
voice_speed 范围为 0.8–2,默认值为 1。
不可以。此版本没有音频 URL 字段。
使用简短、断句清晰的句子,并选择适合视频时长的语速。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





