Crea un breve video con audio sincronizzato da immagini di riferimento e un prompt.
Carica un'immagine iniziale e una finale, aggiungi un brief scritto per ciò che accade nel mezzo e ottieni una breve clip con audio nativo sincronizzato opzionale. Su RunComfy puoi bloccare entrambi i fotogrammi chiave nell'interfaccia utente del modello, quindi riutilizzare lo stesso input su HTTP API.
Formato di output: video/immagini iniziali e finali/5–20 secondi/720p o 1080p/audio nativo opzionale
| Parametro | Obbligatorio | Digitare | Predefinito | Gamma / Opzioni | Descrizione |
|---|---|---|---|---|---|
| start_image_url* | Sì (*) | stringa | — | PNG, JPEG, WebP URL | Immagine utilizzata come primo fotogramma del video. |
| end_image_url* | Sì (*) | stringa | — | PNG, JPEG, WebP URL | Immagine utilizzata come ultimo fotogramma del video. |
| richiesta* | Sì (*) | stringa | — | — | Testo che descrive la transizione e il movimento tra i due fotogrammi. |
| aspect_ratio | No | stringa | automatico | automatico, 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16 | Forma del frame di output; auto lascia scegliere il modello. |
| risoluzione | No | stringa | 720p | 720p, 1080p | Risoluzione di uscita. |
| durata | No | intero | 5 | 5–20 | Durata della clip in secondi; necessario in pratica per poter posizionare il telaio terminale. |
| generate_audio | No | booleano | vero | vero, falso | Se generare audio sincronizzato. |
| safety_tolerance | No | intero | 2 | 0–4 | 0 è il più rigoroso; 4 è il più permissivo. |
La fatturazione per FLUX 3 First Last Frame to Video si basa sulla lunghezza del clip generato e sulla risoluzione selezionata.
| Risoluzione | Vota |
|---|---|
| 720p | $ 0,17 al secondo |
| 1080p | $ 0,29 al secondo |
Esempi di costi stimati (720p)
| Durata | ca. costo |
|---|---|
| 5 s | ~$0,85 |
| 10 secondi | ~$ 1,70 |
| 20 | ~$ 3,40 |
Esempi di costi stimati (1080p)
| Durata | ca. costo |
|---|---|
| 5 s | ~$ 1,45 |
| 10 secondi | ~$2,90 |
| 20 | ~$5,80 |
Crea un breve video con audio sincronizzato da immagini di riferimento e un prompt.
Guida un breve video sorgente con la traccia audio richiesta, quindi controlla le emozioni, l'ambito della modifica, il comportamento di mancata corrispondenza della durata e l'espressività.
Trasforma immagini statiche in video realistici e dinamici in pochi istanti.
Modello di movimento cinematografico per la creazione di scene fluide e l'editing visivo adattivo.
Modifica un video sorgente con un’istruzione testuale mantenendo coerente la scena.
Generazione cinematografica 4K da immagine a $0.42 per secondo di output.
FLUX 3 First Last Frame to Video acquisisce un'immagine iniziale, un'immagine finale e un messaggio di testo, quindi genera il movimento tra questi due fotogrammi chiave con audio nativo sincronizzato opzionale. Si adatta alle transizioni da posa a posa, agli archi di rivelazione del prodotto e ai ponti di scene quando entrambi i fotogrammi dei fermalibri sono già bloccati.
FLUX 3 First Last Frame to Video blocca sia le immagini fisse di apertura che quelle di chiusura, in modo da controllare l'inizio e la fine della clip. FLUX 3 Image to Video richiede solo un'immagine iniziale e continua il movimento da quel singolo fotogramma senza un fotogramma finale richiesto.
SÌ. Genera audio è attivo per impostazione predefinita, quindi FLUX 3 First Last Frame to Video può riprodurre parlato sincronizzato, SFX e atmosfera con l'immagine. Spegnilo quando hai bisogno di un video silenzioso.
La durata è un numero intero di secondi compreso tra 5 e 20. Una lunghezza esplicita aiuta a posizionare correttamente il fotogramma finale per la stimolazione della transizione.
Le opzioni di risoluzione sono 720p (predefinita) e 1080p. Per impostazione predefinita, le proporzioni sono automatiche oppure puoi bloccare 21:9, 2:1, 16:9, 4:3, 1:1, 3:4 o 9:16 per i formati di consegna conosciuti.
start_image_url, end_image_url e il prompt sono obbligatori. I campi facoltativi sono aspect_ratio, risoluzione, durata (5–20, predefinito 5), generate_audio e safety_tolerance (0–4, predefinito 2). Le immagini iniziali e finali devono essere URL PNG, JPEG o WebP.
Crea il prototipo nell'interfaccia utente del modello RunComfy, quindi richiama lo stesso modello tramite l'API RunComfy utilizzando campi di input identici (start_image_url, end_image_url, prompt, aspect_ratio, risoluzione, durata, generate_audio, safety_tolerance). Convalida prima le richieste e i fotogrammi chiave nell'interfaccia utente, quindi utilizza la chiave API e i crediti del tuo account per i processi automatizzati.
La fatturazione si basa sulla durata e sulla risoluzione del video generato: $ 0,17 al secondo a 720p e $ 0,29 al secondo a 1080p. Consulta i prezzi indicati in questa pagina per le tariffe più recenti.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





