logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

FLUX 3 Image to Video:透過模型頁面與 API 實現圖生影片(可選原生音訊)| RunComfy

blackforestlabs/flux-3/image-to-video

FLUX 3 Image to Video 可將起始圖片動畫化為 720p 或 1080p 短片,並支援可選原生音訊。

影片起始畫面的圖片 URL(PNG、JPEG 或 WebP)。
描述你想生成的影片內容的文字提示詞。
生成影片的寬高比。auto 表示由模型自動選擇。
生成影片的解析度。
生成影片的時長(秒)。auto 表示由模型自動選擇。
是否為影片生成同步音訊。
生成影片的安全容忍等級。0 最嚴格,4 最寬鬆。
Idle
The rate is $0.187 per second at 720p, and $0.319 per second at 1080p.

FLUX 3 Image to Video 簡介

Black Forest Labs 的 FLUX 3 Image to Video 從一張靜幀與文字說明出發,生成可選同步原生音訊的短片,支援 720p 或 1080p,單次最長 20 秒。
它以鎖定首幀的提示詞驅動運動,取代手動時間線動畫與另行配音,協助行銷、產品與預演團隊更快把靜圖變成可用短片。
對開發者而言,可在 RunComfy 瀏覽器中使用 FLUX 3 Image to Video,也可透過 HTTP API 呼叫,無需自行託管或擴充模型。
適用場景:產品靜圖動畫 | 角色開場鏡頭 | 由主視覺延展的廣告創意

Black Forest Labs / FLUX 3 Image To Video#


FLUX 3 Image to Video 接收一張靜幀與文字說明,生成可選同步原生音訊的短片。在 RunComfy 中可先在模型介面調整運動,再用相同 Input 透過 HTTP API 重用。


輸出格式:影片 / 從單張圖片起步 / 最長 20 秒 / 720p 或 1080p / 可選原生音訊


亮點#


  • 靜幀到運動: 上傳起始圖片;FLUX 3 Image to Video 在提示詞引導下將該幀延展為連續動作。
  • 同一次生成配音: 保持「生成音訊」開啟即可得到與畫面同步的語音、環境聲與音效;需要靜音成片時關閉即可。
  • 時長可控: 使用自動時長,或鎖定 5–20 秒,為產品節拍與對白留足空間。
  • 構圖選項: 支援超寬 21:9 到直式 9:16,也可選 auto 由模型決定畫幅。
  • 兩檔輸出: 先用 720p 迭代,需要更清晰成片時再升到 1080p。
  • 安全檔位: 將安全容忍度設為 0(最嚴)到 4(最寬),以符合場景需求。

參數#


參數必填類型預設值範圍 / 選項說明
image_url*是 (*)string—PNG、JPEG、WebP URL短片起始畫面。
prompt*是 (*)string——描述影片如何從該圖展開。
aspect_ratio否stringautoauto, 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16輸出畫幅;auto 由模型選擇。
resolution否string720p720p, 1080p輸出解析度。
duration否stringautoauto, 5–20時長(秒);auto 由模型選擇。
generate_audio否booleantruetrue, false是否生成同步音訊。
safety_tolerance否integer20–40 最嚴;4 最寬。

價格#


FLUX 3 Image to Video 依生成時長與所選解析度計費。


解析度費率
720p$0.187 / 秒
1080p$0.319 / 秒

費用估算範例(720p)


時長約合費用
5 s~$0.94
10 s~$1.87
20 s~$3.74

費用估算範例(1080p)


時長約合費用
5 s~$1.60
10 s~$3.19
20 s~$6.38

相關模型

ltx-2/fast/text-to-video

根據文字提示詞生成 16:9 影片,可選擇時長、解析度、幀率以及是否產生音訊。

steady-dancer

依照驅動影片中的動作,讓參考圖片動起來。

ltx-2/retake-video

根據提示詞重做現有影片中的指定片段,並可選擇替換音訊、畫面或同時替換兩者。

kling-2-6/motion-control-standard

以 AI 精準移轉動作,快速產生穩定流暢的角色動畫。

wan-2-2/first-last-frame

以雙影格技術生成高保真流暢影片,提升設計表現力與創作效率。

hailuo-2-3/standard/text-to-video

以文字打造動感影片,Hailuo 2.3 結合高階動態生成技術,讓創作者輕鬆產出逼真10秒短片。

常見問題

FLUX 3 Image to Video 有什麼用途?

FLUX 3 Image to Video 從一張靜幀與文字提示詞出發,生成可選同步原生音訊的短片。適合產品動畫、角色開場,以及首幀已經鎖定的廣告創意。

FLUX 3 Image to Video 與文生影片版 FLUX 3 有何不同?

FLUX 3 Image to Video 用你上傳的靜幀錨定開場畫面,再從該幀繼續運動。文生影片版 FLUX 3 僅憑提示詞發明整段鏡頭,不需要起始圖片。

FLUX 3 Image to Video 支援原生音訊嗎?

支援。「生成音訊」預設開啟,因此 FLUX 3 Image to Video 可輸出與畫面同步的語音、音效與環境聲。需要靜音影片時關閉即可。

FLUX 3 Image to Video 最長可以生成多久?

可將時長設為 auto,或鎖定 5 到 20 秒。auto 由模型選擇;固定時長便於產品節拍與對白的可預期節奏。

FLUX 3 Image to Video 支援哪些解析度與寬高比?

解析度為 720p(預設)與 1080p。寬高比預設為 auto,也可鎖定 21:9、2:1、16:9、4:3、1:1、3:4 或 9:16 以符合投放規格。

FLUX 3 Image to Video 需要哪些輸入?

image_url 與 prompt 為必填。可選欄位包括 aspect_ratio、resolution、duration、generate_audio 與 safety_tolerance(0–4,預設 2)。起始圖片應為 PNG、JPEG 或 WebP 的 URL。

如何從瀏覽器試用 FLUX 3 Image to Video 轉到生產環境 API?

先在 RunComfy 模型介面試跑,再透過 RunComfy API 呼叫同一範本,使用相同 Input 欄位(image_url、prompt、aspect_ratio、resolution、duration、generate_audio、safety_tolerance)。先在介面驗證提示詞與起始幀,再用帳戶 API Key 與點數做自動化任務。

在 RunComfy 上使用 FLUX 3 Image to Video 如何計費?

依生成影片時長與解析度計費:720p 為每秒 $0.187,1080p 為每秒 $0.319。以本頁顯示的最新價格為準。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

FLUX 3 Image to Video 生成範例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...