logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Wan 3.0 Text To Video:Models and API 上的电影提示剪辑生成 | RunComfy

wan-ai/wan-3.0/text-to-video

Wan 3.0 Text To Video 将自然语言提示转换为具有灵活持续时间、宽高比和可选同步音频的连贯电影剪辑。

描述您想要生成的场景、主题、动作、摄像机移动、灯光和动作。
输出分辨率层。使用 480p 进行快速草稿,使用 1080p 获得更高质量的输出。
生成视频的输出宽高比。
生成视频的长度(以秒为单位)。范围为 2-30。开始时进行短距离迭代,然后在运动看起来正确后增加。
为具有多种动作或构图要求的复杂场景提供更深入的提示解释。
打开时,输出视频包括同步音轨。关闭以获得无声剪辑。
随机种子以获得可重复的结果。范围为 0 到 2147483647。
Idle
The rate is $0.06 per second for 480p, $0.12 per second for 720p, and $0.25 per second for 1080p.

Wan 3.0 Text To Video 简介

Wan 3.0 Text To Video 直接从书面场景生成电影剪辑,持续时间为 2-30 秒,具有宽高比控制、可选音频和思考模式,可实现更刻意的提示阅读。它可以将故事板和素材片段换成即时驱动的镜头,帮助营销人员、电影制作人和社交团队在几分钟内将想法可视化。对于开发人员来说,RunComfy 上的 Wan 3.0 Text To Video 既可以在浏览器中使用,也可以通过 HTTP API 使用,因此您无需自己托管或扩展模型。
非常适合:概念预览 |广告和促销镜头|垂直社交视频

Wan-AI / Wan 3.0 Text To Video#


Wan 3.0 Text To Video 读取简单语言描述并返回一个简短的电影剪辑。您描述主题、动作、摄像机和光线;该模型可以构图、驱动动作,并且可以一次性添加匹配的音频。


本页涵盖 Wan 3.0 系列的纯文本端点。无需上传图像,因此这是一种快速探索想法、勾画场景或仅通过文字制作完成的短镜头的方法。


亮点#


  • 提示剪辑: 从文本生成完整镜头,无需参考图像。
  • 电影动作: 通过提示直接移动相机和主体动作,以获得连贯的、类似电影的效果。
  • 灵活的长度: 选择 2 至 30 秒,因此快速测试和较长的单次拍摄都适合。
  • 纵横比控制:为任何放置渲染 16:9、9:16、1:1、4:3 或 3:4。
  • 可选音频: 添加同步轨道,或导出无声剪辑。

参数#


参数必填类型默认范围/选项描述
提示*是 (*)字符串--场景、主题、动作、摄像机、灯光和动作。
分辨率没有字符串720p480p、720p、1080p输出分辨率层。
aspect_ratio没有字符串16:916:9、9:16、1:1、4:3、3:4、adaptive输出纵横比。
持续时间没有整数52-302-30输出长度(以秒为单位)。
thinking_mode没有布尔假真/假对复杂提示进行更深入的解释。
enable_audio没有布尔真实真/假包括同步音轨。
种子没有整数随机0-2147483647可重复结果的种子。

定价#


定价取决于所选分辨率:480p 每秒 0.06 美元,720p 每秒 0.12 美元,1080p 每秒 0.25 美元。启用或禁用音频不会更改速率。

相关模型

seed-audio-1.0/text-to-audio

根据文字、参考音频或图像生成自然的语音与音频。

kling-3.0/pro/text-to-video

Kling V3.0 系列中具有最高视觉保真度的优质电影文本转视频。

pika-2-2/image-to-video

Pika 2.2 让设计师轻松将图片或文字提示转化为高质量视频,快速实现创意动画。

veo-3-1/reference-to-video

Veo 3.1 帮助设计师快速将图像转换为高质量动态视频,创作流畅又真实的视觉作品。

react-1

使用必填音频驱动一段短视频,并控制情绪、编辑范围、音视频时长不一致时的处理方式和表现力。

SkyReels V1

支持33种表情与400+动作组合,打造电影质感AI短视频

常见问题

Wan 3.0 Text To Video 有何用途?

Wan 3.0 Text To Video 直接根据书面提示生成简短的电影剪辑,无需参考图像。它对于概念预可视化、广告和促销镜头以及社交视频非常有用,让您只需几分钟即可通过文字将想法形象化。

Wan 3.0 Text To Video 与图像到视频端点有何不同?

文本到视频端点仅从提示开始,因此模型组成了整个场景,而图像到视频端点则对您提供的特定第一帧进行动画处理。当您希望模型发明取景时,选择 Wan 3.0 Text To Video;当您已经有了开场镜头时,选择图像到视频。

Wan 3.0 Text To Video 中的快速依从性和运动质量有多好?

Wan 3.0 Text To Video 遵循结构化提示,命名主题、动作、摄像机移动和灯光,并产生连贯的、电影般的动作。清晰、具体的提示以及每次拍摄的单个摄像机方向通常会给出最可预测的结果。

Wan 3.0 Text To Video 支持哪些分辨率、持续时间和宽高比?

它支持 480p、720p 和 1080p 输出,持续时间从 2 到 30 秒,宽高比包括 16:9、9:16、1:1、4:3 和 3:4。使用 480p 进行快速草稿,使用 1080p 进行交付;检查 RunComfy 面板以了解确切的电流限制。

Wan 3.0 Text To Video 可以向剪辑添加音频吗?

是的。 Wan 3.0 Text To Video 可以生成与视频同步的音轨,并且您可以禁用音频以进行静默导出。启用或禁用音频不会影响价格。

Wan 3.0 Text To Video中的思维模式是什么?

思维模式可以对提示进行更审慎的解释,这在场景结合了多个动作、主题或构图规则时会有所帮助。它是可选的,默认情况下处于关闭状态,因此您可以针对复杂的提示启用它,而对于简单的提示则将其关闭。

开发者可以通过 RunComfy API 调用 Wan 3.0 Text To Video 吗?

是的。您可以在 RunComfy 模型 UI 中对 Wan 3.0 Text To Video 进行原型设计,然后使用相同的参数通过 RunComfy HTTP API 调用相同的模型。这使得从浏览器测试转移到自动化生产工作流程变得简单。

Wan 3.0 Text To Video 的 RunComfy 费用是多少?

各代人根据分辨率和持续时间消耗美元或积分:480p 每秒 0.06 美元,720p 每秒 0.12 美元,1080p 每秒 0.25 美元。新用户通常会收到免费试用金额以首先测试 Wan 3.0 Text To Video。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Wan 3.0 Text To Video 的示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...