logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

FLUX 3 Image to Video:通过模型页面与 API 实现图生视频(可选原生音频)| RunComfy

blackforestlabs/flux-3/image-to-video

FLUX 3 Image to Video 可将起始图片动画化为 720p 或 1080p 短片,并支持可选原生音频。

视频起始画面的图片 URL(PNG、JPEG 或 WebP)。
描述你想生成的视频内容的文本提示词。
生成视频的宽高比。auto 表示由模型自动选择。
生成视频的分辨率。
生成视频的时长(秒)。auto 表示由模型自动选择。
是否为视频生成同步音频。
生成视频的安全容忍级别。0 最严格,4 最宽松。
Idle
The rate is $0.187 per second at 720p, and $0.319 per second at 1080p.

FLUX 3 Image to Video 简介

Black Forest Labs 的 FLUX 3 Image to Video 从一张静帧与文字说明出发,生成可选同步原生音频的短片,支持 720p 或 1080p,单次最长 20 秒。
它以锁定首帧的提示词驱动运动,替代手动时间线动画与另行配音,帮助营销、产品与预演团队更快把静图变成可用短片。
对开发者而言,可在 RunComfy 浏览器中使用 FLUX 3 Image to Video,也可通过 HTTP API 调用,无需自行托管或扩展模型。
适用场景:产品静图动画 | 角色开场镜头 | 由主视觉延展的广告创意

Black Forest Labs / FLUX 3 Image To Video#


FLUX 3 Image to Video 接收一张静帧与文字说明,生成可选同步原生音频的短片。在 RunComfy 中可先在模型界面调整运动,再用相同 Input 通过 HTTP API 复用。


输出格式:视频 / 从单张图片起步 / 最长 20 秒 / 720p 或 1080p / 可选原生音频


亮点#


  • 静帧到运动: 上传起始图片;FLUX 3 Image to Video 在提示词引导下将该帧延展为连续动作。
  • 同一次生成配音: 保持「生成音频」开启即可得到与画面同步的语音、环境声与音效;需要静音成片时关闭即可。
  • 时长可控: 使用自动时长,或锁定 5–20 秒,为产品节拍与对白留足空间。
  • 构图选项: 支持超宽 21:9 到竖屏 9:16,也可选 auto 由模型决定画幅。
  • 两档输出: 先用 720p 迭代,需要更清晰成片时再升到 1080p。
  • 安全档位: 将安全容忍度设为 0(最严)到 4(最宽),以匹配场景需求。

参数#


参数必填类型默认值范围 / 选项说明
image_url*是 (*)string—PNG、JPEG、WebP URL短片起始画面。
prompt*是 (*)string——描述视频如何从该图展开。
aspect_ratio否stringautoauto, 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16输出画幅;auto 由模型选择。
resolution否string720p720p, 1080p输出分辨率。
duration否stringautoauto, 5–20时长(秒);auto 由模型选择。
generate_audio否booleantruetrue, false是否生成同步音频。
safety_tolerance否integer20–40 最严;4 最宽。

价格#


FLUX 3 Image to Video 按生成时长与所选分辨率计费。


分辨率费率
720p$0.187 / 秒
1080p$0.319 / 秒

费用估算示例(720p)


时长约合费用
5 s~$0.94
10 s~$1.87
20 s~$3.74

费用估算示例(1080p)


时长约合费用
5 s~$1.60
10 s~$3.19
20 s~$6.38

相关模型

ace-step/audio-inpaint

精确重制音轨中的指定片段,其余部分保持不变。

flux-3/first-last-frame-to-video/draft

FLUX 3 Draft FLF:720p 快速开始结束帧视频预览

hailuo-2-3/pro/text-to-video

智能文本转视频工具,支持1080p高质量生成,轻松打造生动镜头与真实情感,激发创作灵感。

pixverse/v5.5/transition

以必填的起始图片和结束图片生成转场视频,并可控制提示词、宽高比、分辨率、时长、风格、音频和提示词优化。

creatify/lipsync

将音频轨道与视频同步,并设置是否循环视频。

hailuo-2-3/fast/standard/image-to-video

使用Hailuo 2.3 Fast Standard将静态图像快速生成流畅逼真的视频,助力设计师轻松实现创意动态化。

常见问题

FLUX 3 Image to Video 有什么用途?

FLUX 3 Image to Video 从一张静帧与文本提示词出发,生成可选同步原生音频的短片。适合产品动画、角色开场,以及首帧已经锁定的广告创意。

FLUX 3 Image to Video 与文生视频版 FLUX 3 有何不同?

FLUX 3 Image to Video 用你上传的静帧锚定开场画面,再从该帧继续运动。文生视频版 FLUX 3 仅凭提示词发明整段镜头,不需要起始图片。

FLUX 3 Image to Video 支持原生音频吗?

支持。「生成音频」默认开启,因此 FLUX 3 Image to Video 可输出与画面同步的语音、音效与环境声。需要静音视频时关闭即可。

FLUX 3 Image to Video 最长可以生成多久?

可将时长设为 auto,或锁定 5 到 20 秒。auto 由模型选择;固定时长便于产品节拍与对白的可预期节奏。

FLUX 3 Image to Video 支持哪些分辨率与宽高比?

分辨率为 720p(默认)与 1080p。宽高比默认为 auto,也可锁定 21:9、2:1、16:9、4:3、1:1、3:4 或 9:16 以匹配投放规格。

FLUX 3 Image to Video 需要哪些输入?

image_url 与 prompt 为必填。可选字段包括 aspect_ratio、resolution、duration、generate_audio 与 safety_tolerance(0–4,默认 2)。起始图片应为 PNG、JPEG 或 WebP 的 URL。

如何从浏览器试用 FLUX 3 Image to Video 转到生产环境 API?

先在 RunComfy 模型界面试跑,再通过 RunComfy API 调用同一模板,使用相同 Input 字段(image_url、prompt、aspect_ratio、resolution、duration、generate_audio、safety_tolerance)。先在界面验证提示词与起始帧,再用账户 API Key 与积分做自动化任务。

在 RunComfy 上使用 FLUX 3 Image to Video 如何计费?

按生成视频时长与分辨率计费:720p 为每秒 $0.187,1080p 为每秒 $0.319。以本页展示的最新价格为准。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • 查看所有模型 →
图像模型
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

FLUX 3 Image to Video 生成示例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...