Trasforma un ritratto e una traccia audio in un video con avatar parlante, con un prompt opzionale di movimento o indicazioni sul modo di parlare.
FLUX 3 Image to Video prende un fotogramma fisso più un brief e li trasforma in un clip breve con audio nativo sincronizzato opzionale. Su RunComfy puoi regolare il movimento nella UI del modello e riusare lo stesso Input via HTTP API.
Formato di output: Video / parte da un'immagine / fino a 20 secondi / 720p o 1080p / audio nativo opzionale
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| image_url* | Sì (*) | string | — | URL PNG, JPEG, WebP | Fotogramma iniziale del clip. |
| prompt* | Sì (*) | string | — | — | Testo su come il video si sviluppa dall'immagine. |
| aspect_ratio | No | string | auto | auto, 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16 | Forma del frame; auto lascia scegliere al modello. |
| resolution | No | string | 720p | 720p, 1080p | Risoluzione di output. |
| duration | No | string | auto | auto, 5–20 | Durata in secondi; auto lascia scegliere al modello. |
| generate_audio | No | boolean | true | true, false | Se generare audio sincronizzato. |
| safety_tolerance | No | integer | 2 | 0–4 | 0 più rigoroso; 4 più permissivo. |
La fatturazione di FLUX 3 Image to Video si basa sulla durata del clip e sulla risoluzione scelta.
| Risoluzione | Tariffa |
|---|---|
| 720p | $0.17 al secondo |
| 1080p | $0.29 al secondo |
Esempi di costo stimato (720p)
| Durata | Costo approx. |
|---|---|
| 5 s | ~$0.85 |
| 10 s | ~$1.70 |
| 20 s | ~$3.40 |
Esempi di costo stimato (1080p)
| Durata | Costo approx. |
|---|---|
| 5 s | ~$1.45 |
| 10 s | ~$2.90 |
| 20 s | ~$5.80 |
Trasforma un ritratto e una traccia audio in un video con avatar parlante, con un prompt opzionale di movimento o indicazioni sul modo di parlare.
Video realistici da testo o immagine con controllo creativo totale.
Genera dal testo video cinematografici di 3–15 s con audio opzionale.
Trasforma facilmente immagini in video cinematografici con Veo 3.1 Fast.
Controllo visivo avanzato per video realistici e animazioni fluide
FLUX 3 Video trasforma i suggerimenti di testo in clip cinematografiche con audio nativo
FLUX 3 Image to Video parte da un'immagine fissa e un prompt di testo, poi genera un clip breve con audio nativo sincronizzato opzionale. È adatto ad animazione di prodotto, aperture di personaggio e creative ads quando il primo fotogramma è già bloccato.
FLUX 3 Image to Video ancora l'aspetto di apertura allo still caricato e continua il movimento da quel fotogramma. Il FLUX 3 text-to-video inventa l'intero shot solo dal prompt, senza immagine iniziale obbligatoria.
Sì. Generate Audio è attivo di default, quindi FLUX 3 Image to Video può produrre parlato, SFX e ambience sincronizzati all'immagine. Disattivalo se ti serve video muto.
Puoi impostare duration su auto o fissare da 5 a 20 secondi. auto lascia scegliere al modello; le lunghezze fisse danno un ritmo prevedibile per beat di prodotto e dialoghi.
Risoluzioni: 720p (predefinito) e 1080p. Il formato predefinito è auto; puoi anche bloccare 21:9, 2:1, 16:9, 4:3, 1:1, 3:4 o 9:16.
image_url e prompt sono obbligatori. Opzionali: aspect_ratio, resolution, duration, generate_audio e safety_tolerance (0–4, predefinito 2). L'immagine iniziale deve essere un URL PNG, JPEG o WebP.
Fai il prototipo nella UI modello di RunComfy, poi chiama lo stesso template tramite l'API RunComfy con gli stessi campi Input (image_url, prompt, aspect_ratio, resolution, duration, generate_audio, safety_tolerance). Valida prima prompt e fotogrammi iniziali nella UI, poi usa API key e crediti dell'account per i job automatici.
La fatturazione dipende da durata e risoluzione: $0.17 al secondo a 720p e $0.29 al secondo a 1080p. Vedi le tariffe mostrate in questa pagina.
RunComfy is the premier ComfyUI platform, offering ComfyUI online environment and services, along with ComfyUI workflows featuring stunning visuals. RunComfy also provides AI Models, enabling artists to harness the latest AI tools to create incredible art.





