通过多模态参考、口型同步和镜头控制,更快生成具有电影感的短视频。
下表列出了本页 Seedance 2.5 Reference to Video 720p 工具公开的控件。
| 参数 | 必填 | 类型 | 默认 | 范围 / 选项 | 如何选择 |
|---|---|---|---|---|---|
prompt* | 是 (*) | string | 示例提示词 | 建议中文约 ≤500 字,或英文约 ≤1000 词 | 描述动作与镜头;参考用于锚定身份、运动与情绪。 |
images | 否 | array(图片 URL) | 示例图片 | 最多 9 | jpeg, png, webp, bmp, tiff, gif;引导身份与风格。 |
videos | 否 | array(视频 URL) | [] | 最多 3 | mp4, mov;每段约 2–15 秒;携带运镜与节奏。 |
audios | 否 | array(音频 URL) | [] | 最多 3 | wav, mp3;约 2–15 秒,小于 15 MB;设定情绪。 |
aspect_ratio | 否 | string | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, 21:9, adaptive | 匹配目标画幅;adaptive 让模型选择最接近的比例。 |
duration | 否 | integer | 5 | 4–30 秒,以 1 秒为步进 | 单一动作用短片;仅当提示有清晰弧线时再用更长时长。 |
generate_audio | 否 | boolean | true | true / false | 需要同步语音、音效与音乐时保持开启;只要静音视频则关闭。 |
\* 必填字段。仅 prompt 必填;参考为可选,但建议用于更一致的结果。
无参考视频每秒 $0.306,有参考视频每秒 $0.187。
通过多模态参考、口型同步和镜头控制,更快生成具有电影感的短视频。
在必填起始图片与结束图片之间生成 5 秒或 10 秒视频,并通过包含 @Image1 和 @Image2 引用的必填提示词引导转场。
根据参考图像和提示词生成带同步音频的短视频。
在指定的开始帧和结束帧之间创建平滑的 V6 运动。
使用Veo 3.1 Fast轻松将图片或文字转化为高质量电影级视频,创作高效灵活。
通过文字指令编辑现有视频,可添加最多 10 张参考图片,并选择是否保留原声。
它指导带有参考图像和可选视频或音频的 720p 剪辑,保持身份、服装和风格一致。它适合角色一致的视频、产品参考剪辑和风格锁定的品牌视频。
您附加参考材料 - 最多 9 张图像、3 个短片和 3 个音频剪辑 - 并在提示中描述镜头。参考主播身份、着装、风格、动作和声音,而提示则指导动作和镜头。仅严格要求提示。
最多 9 个参考图像、3 个参考视频和 3 个参考音频文件(参考视频和音频各约 2-15 秒;音频小于 15 MB)。持续时间是从 4 到 30 的整数秒(默认为 5)。宽高比可以是 16:9 (默认)、9:16、1:1、4:3、3:4、21:9 或自适应。输出固定为 720p。
不。它可以仅通过文本提示加上图像来运行。当您需要更强的动作或情绪指导时,添加简短的参考视频或音频。
是的。 generate_audio 默认开启,因此模型可以输出同步语音、效果和音乐。当您只需要无声视频时将其关闭。
是的。在 RunComfy 模型 UI 中创建原型,然后通过具有匹配字段(prompt、images、videos、audios、aspect_ratio、duration、generate_audio)的 API 调用同一模板。几代人在两条路径上都消耗积分。
无参考视频:总价 = 输出视频时长 × $0.306。有参考视频:总价 =(输入参考视频时长 + 输出时长)× $0.187。示例:10 秒参考视频 + 10 秒输出 = 20 秒 × $0.187 = $3.74。图像和音频参考不收费。
两者共享相同的参考引导路径和 4-30 秒窗口;此页面输出于 720p。如需更便宜、更快的草稿,请使用 480p 视频参考页面。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





