根据图片、音频和提示词生成视频,并分别调整文字与音频的引导强度。
Seedance 2.5 是 ByteDance Seed 的下一代多模式视频模型,用于从文本和参考媒体生成电影剪辑。此页面提供 Seedance 2.5 Text-to-Video:将一个书面提示转换为 720p 的 4-30 秒剪辑,并可选配与图片生成的同步原生音频。它只接受文本;当您需要图像、参考或第一帧和最后一帧输入时,请使用其他 Seedance 2.5 页面。
| Seedance 2.5优势 | 这对您意味着什么 |
|---|---|
| 一次性原生音频 | 与视频一起生成同步语音、音效和音乐,这样您就可以跳过单独的配音和声音设计步骤。当您只需要无声视频时将其关闭。 |
| 长达 30 秒的剪辑 | 导演一个较长的单镜头,有清晰的开头、发展和结尾,而不是拼接多个短镜头。 |
| 更强的一致性和更清晰的扩展 | Seedance 2.5 的目标是更稳定的角色、服装和风格,并抑制镜头延长时产生的模糊。 |
| 即时驱动控制 | 对于定时动作、取景和多语言场景,更可靠地遵循负面和时间戳风格的指令。 |
__PH35__ 短片、卷轴和故事或 __PH38__ 饲料资产,具有清晰的开头挂钩和平台就绪框架。下表列出了此页面上 Seedance 2.5 Text-to-Video 工具公开的控件。
| 参数 | 必填 | 类型 | 默认 | 范围/选项 | 如何选择 |
|---|---|---|---|---|---|
prompt* | 是 (*) | 字符串 | 示例提示 | 建议中文~≤500字或英文~≤1000字 | 给 Seedance 2.5 一份结构化的简介,涵盖主题、主要动作、摄像机、背景和灯光、视觉风格和任何音频。 |
aspect_ratio | 没有 | 字符串 | __PH34__ | __PH34__、__PH35__、__PH38__、__PH39__、__PH40__、__PH36__、adaptive | 匹配目的地:__PH34__ 用于一般视频和广告,__PH35__ 用于垂直社交,__PH38__ 用于信息流,__PH36__ 用于超宽。 adaptive 让模型选择最接近的比率。 |
duration | 没有 | 整数 | 5 | 4-30 秒,以 1 秒为步长 | 使用短剪辑进行单一动作;为定义明确的开始、发展和结束的提示保留更长的持续时间。 |
generate_audio | 没有 | 布尔 | true | true / false | 开启同步语音、效果和音乐;关闭静音视频。 |
\* 必填字段。
下表总结了 RunComfy 上更广泛的 Seedance 2.5 系列。图像、参考和第一帧/最后一帧输入可在单独的页面上使用,而不是作为此文本转视频页面上的控件。| Seedance 2.5 页 |该页面上的输入 |笔记|
| --- | --- | --- |
|---|---|---|
| 文本转视频(本页) | 仅 prompt,加上 aspect_ratio、duration、generate_audio | 纯文本;在固定的 720p 处输出(也可以使用 480p 页)。 |
| 图像到视频 | prompt + 一个 image | 动画静止图像;输出宽高比遵循输入图像。 |
| 参考视频 | prompt + 最多 9 个 images、3 个 videos、3 个 audios,加上 aspect_ratio | 参考文献引导身份、动作和情绪。 |
| 第一帧和最后一帧 | prompt + first_frame + last_frame | 连接两个关键帧;输出纵横比遵循帧。 |
每个页面运行 4-30 秒的剪辑,并可以生成可选的原生音频。
Seedance 2.5 Text-to-Video 按每秒生成的视频按固定 720p 计费:
| 持续时间 | 价格为 $0.35/秒 |
|---|---|
| 5秒 | $1.75 |
| 10 秒 | $3.50 |
| 15 秒 | $5.25 |
| 30 多岁 | $10.50 |
对于多个输出批次,将总计计算为 duration × __PH23__ × output count。
使用这个可重用的 Seedance 2.5 提示结构:
[subject + defining details] + [one action over time] + [camera framing and movement] + [setting + lighting] + [visual treatment] + [dialogue / effects / ambience / music] + [ending frame or constraint]
弱提示
> 夜晚的复古餐厅,电影般,下着雨。
改进了 Seedance 2.5 提示
> 一家复古美式路边餐厅在黄昏时分闪闪发光,温暖的霓虹灯招牌上写着“餐厅”和“营业”,小雨给空荡荡的停车场蒙上了一层薄雾,五颜六色的倒影在潮湿的沥青上闪闪发光。从一个广角定场镜头开始,然后随着一辆老爷车的车头灯掠过而缓慢推入镜头。带有软镜头光晕的电影变形外观;音频:细雨和遥远的雷声氛围,没有对话。
改进后的版本为 Seedance 2.5 提供了可识别的主题、定时动作、独立的摄像机方向、灯光、饰面和声源。
根据图片、音频和提示词生成视频,并分别调整文字与音频的引导强度。
使用一张人像和一段音频生成口播数字人视频,并可通过提示词引导动作与表达方式。
使用 Wan 2.2 Plus 根据提示词生成 5 秒视频,并设置尺寸、随机种子和提示词扩展。
Seedance 2.5:将静态图像动画化为电影 AI 视频
将驱动视频中的动作迁移到参考角色图片,同时尽量保持角色可辨识。
通过遮罩或区域描述替换视频中的选定区域,并可按需使用图像和提示词。
是的。 Seedance 2.5 Text-to-Video 可在 RunComfy 上使用,用于浏览器测试和 API 集成。
Seedance 2.5 是 ByteDance Seed 的下一代多模态视频模型。其更广泛的系列涵盖文本、图像、视频和音频输入,而各个 RunComfy 页面则公开不同的控件。此页面提供纯文本文本到视频的工作流程。
Seedance 2.5 Text-to-Video 将提示变成带有可选原生音频的简短电影剪辑。它的目标是广告创意、电影预览和品牌故事讲述,其中提示驱动的控制和同步音频很重要。
视频在此页面上以固定的 720p 输出。长宽比可以是 16:9 (默认)、9:16、1:1、4:3、3:4、21:9 或自适应(模型选择最接近的比例)。持续时间是 4 到 30 之间的整数秒,默认值为 5。
是的。 generate_audio 默认开启,因此该模型可以输出同步语音、音效和音乐,支持口型同步剪辑。当您只需要无声视频时将其关闭。音频质量仍然取决于提示的清晰度和您描述的场景。
不可以。此页面是纯文本 Seedance 2.5 Text-to-Video 工作流程,其 API 仅接受 prompt、aspect_ratio、duration 和 generate_audio。对于源媒体,请使用单独的 Seedance 2.5 Image-to-Video、视频参考或第一帧和最后一帧页面。
不会。RunComfy 通过浏览器提供 Seedance 2.5 和 HTTP API,因此您无需自行托管或缩放模型。
在 RunComfy 模型 UI 中创建原型,然后使用相同的输入字段(prompt、aspect_ratio、duration、generate_audio)通过 RunComfy API 调用同一模型。首先验证 UI 中的提示,然后使用您的帐户 API 密钥和积分进行自动化作业。
代数按每秒 720p 生成的视频时长 $0.35 进行计费。 5 秒剪辑的成本约为 $1.75,30 秒剪辑的成本约为 $10.50。有关实时定价,请参阅本页上的“生成”部分。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





