logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Wan 3.0 Reference To Video:Models and API 上的多模态参考视频生成 | RunComfy

wan-ai/wan-3.0/reference-to-video

Wan 3.0 Reference To Video 将提示与图像、视频和音频参考相结合,以构建具有一致主题、动作和声音的连贯剪辑。

描述场景、主题、动作、摄像机移动、灯光和风格。按顺序参考图像 1、视频 1、音频 1。
Image 1
最多 10 个参考图像,以确保主题、物体或场景的一致性。至少需要一份参考资料(图像、视频或音频)。
最多 5 个参考视频(MP4 或 MOV,每个 1-15 秒,总计不超过 15 秒)用于动作或场景指导。
最多 5 个参考音频剪辑(总计不超过 15 秒)来指导声音或计时。
输出分辨率层。使用 480p 进行快速草稿,使用 1080p 获得更高质量的输出。
生成视频的输出宽高比。
生成视频的长度(以秒为单位)。范围为 2-30。开始时进行短距离迭代,然后在运动看起来正确后增加。
为具有多种动作或构图要求的复杂场景提供更深入的提示解释。
打开时,输出视频包括同步音轨。关闭以获得无声剪辑。
随机种子以获得可重复的结果。范围为 0 到 2147483647。
Idle
The rate is $0.06 per second for 480p, $0.12 per second for 720p, and $0.25 per second for 1080p.

Wan 3.0 Reference To Video 简介

Wan 3.0 Reference To Video 根据提示和多模式参考(包括图像、视频和音频)组装一个连贯的剪辑,持续时间为 2-30 秒,并具有长宽比控制。它以参考指导的一致性取代脆弱的合成,帮助工作室、广告团队和创作者在整个镜头中保持角色、物体、动作和声音的品牌特色。对于开发人员来说,RunComfy 上的 Wan 3.0 Reference To Video 既可以在浏览器中使用,也可以通过 HTTP API 使用,因此您无需自己托管或扩展模型。
非常适合: 字符一致性 |品牌产品场景|多模式讲故事

Wan-AI / Wan 3.0 Reference To Video#


Wan 3.0 Reference To Video 将文本提示与参考媒体结合起来,并创作一个新的剪辑来纪念它们。提供参考图像、视频或音频,然后在提示中将其指向“图像 1”、“视频 1”或“音频 1”,以控制出现的人员、他们的移动方式以及场景的声音。


此参考端点是为了一致性工作而构建的:重复出现的角色、特定产品、从剪辑中提取的运动风格或带入新镜头的音频感觉。参考文献按照您提供的顺序进行匹配。


亮点#


  • 多模式参考: 使用最多 10 个图像、5 个视频和 5 个音频剪辑来指导拍摄。
  • 主题一致性: 保持剪辑中的角色、产品或物体可识别。
  • 动作和时间提示: 从参考视频中借用动作或节奏。
  • 音频指导: 使用参考音频来引导结果的声音和节奏。
  • 灵活的输出: 设置 2 到 30 秒并选择最终放置的宽高比。

参数#


参数必填类型默认范围/选项描述
提示*是 (*)字符串--场景、主题、动作、相机、灯光和风格。
reference_images有条件数组空最多 10 个主题或场景一致性的参考图像。
reference_videos有条件数组空最多 5参考视频(每个 1-15 秒,总共 15 秒)。
reference_audios有条件数组空最多 5参考音频(总共 15 秒)。
分辨率没有字符串720p480p、720p、1080p输出分辨率层。
aspect_ratio没有字符串16:916:9、9:16、1:1、4:3、3:4、adaptive输出纵横比。
持续时间没有整数52-302-30输出长度(以秒为单位)。
thinking_mode没有布尔假真/假对复杂提示进行更深入的解释。
enable_audio没有布尔真实真/假包括同步音轨。
种子没有整数随机0-2147483647可重复结果的种子。

至少提供 reference_images、reference_videos 或 reference_audios 之一。


定价#


定价取决于所选分辨率:480p 每秒 0.06 美元,720p 每秒 0.12 美元,1080p 每秒 0.25 美元。启用或禁用音频不会更改速率。

相关模型

Veo 2

支持精准动作、镜头控制与真实物理感,助力创意视频设计

pixverse/v5.5/effects

使用 48 个效果预设之一为 1 张必填源图片制作动画,并可设置分辨率、时长、反向提示词和提示词优化。

bytedance/upscale/video

将源视频放大到所选目标分辨率和帧率。

veo-3-1/extend-video

根据提示词将现有视频续写 7 秒,以 720p 输出,并可选择是否生成音频。

live-avatar

将静态人像转化为表情自然、栩栩如生且可精细控制的视频。

wan-2-2/vace-fun

根据必填提示词将一张必填的参考图像制作成视频。可设置输出尺寸、帧数、播放帧率、随机种子、步数、引导强度和 shift。

常见问题

Wan 3.0 Reference To Video 有何用途?

Wan 3.0 Reference To Video 根据文本提示与图像、视频和音频等参考媒体相结合构建剪辑。它专为一致性工作而设计:在新镜头中保持角色、产品或动作风格可识别,而不是手动合成。

Wan 3.0 Reference To Video 可以接受哪些类型的参考文献?

它在一次请求中最多接受 10 个参考图像、最多 5 个参考视频和最多 5 个参考音频剪辑。图像有助于锁定身份,视频引导动作或步调,音频引导声音,您可以将提示中的每一个指定为“图像 1”、“视频 1”或“音频 1”。

Wan 3.0 Reference To Video 如何保持主题一致?

因为您提供了直接的视觉引用,所以 Wan 3.0 Reference To Video 可以比单独的提示更可靠地将角色或对象的外观带入生成的场景中。干净的单一主题参考图像通常可以提供最强的身份锁定。

参考视频和音频有哪些限制?

参考视频应为 MP4 或 MOV,每个视频时长 1 至 15 秒,参考视频总时长不超过 15 秒。参考音频总共也保持在约 15 秒内。运行前检查 RunComfy 参数面板以了解确切的电流限制。

Wan 3.0 Reference To Video 支持哪些输出设置?

输出可采用 480p、720p 或 1080p,持续时间为 2 至 30 秒,宽高比包括 16:9、9:16、1:1、4:3 和 3:4。您还可以生成同步音轨或导出静音剪辑。

我什么时候应该使用参考视频而不是图像到视频?

当您需要在多个参考之间保持一致性或在一次拍摄中混合图像、视频和音频指导时,请使用 Wan 3.0 Reference To Video。当您只想为已有的单个第一帧制作动画时,请使用图像到视频。

开发人员可以通过 RunComfy API 使用 Wan 3.0 Reference To Video 吗?

是的。您可以在 RunComfy 模型 UI 中对 Wan 3.0 Reference To Video 进行原型设计,然后通过 RunComfy HTTP API 使用相同的参数调用相同的模型。这可以使您的参考驱动设置在浏览器测试和生产自动化之间保持一致。

Wan 3.0 Reference To Video 到 RunComfy 的费用是多少?

各代人根据分辨率和持续时间消耗美元或积分:480p 每秒 0.06 美元,720p 每秒 0.12 美元,1080p 每秒 0.25 美元。新用户通常会获得免费试用量,以便在大规模运行之前尝试 Wan 3.0 Reference To Video。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Wan 3.0 Reference To Video 的示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...