Genera video cinematografici con movimenti di camera e template AI
È il modello 4K image-to-video della famiglia O3 di Kuaishou, ottimizzato per il rendering finale e per mantenere stabile il soggetto dell’immagine sorgente. Fornisci un’immagine iniziale e una descrizione per ottenere una clip 4K da 3 a 15 secondi con movimento fisicamente realistico e audio opzionale.
È pensato per trasformare una foto, uno scatto prodotto o un keyframe preciso in un video 4K di livello broadcast, senza riprese, rotoscoping manuale o GPU proprie.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| image* | Sì (*) | string (URL) | — | URL pubblico | Immagine del primo fotogramma che vincola la clip. |
| prompt* | Sì (*) | string | — | Testo libero | Movimento, camera, illuminazione e atmosfera. |
| end_image | No | string (URL) | — | URL pubblico | Ultimo fotogramma opzionale per controllare il movimento. |
| duration | No | integer | 5 | Da 3 a 15 | Durata in secondi; il prezzo cresce linearmente. |
| sound | No | boolean | false | true / false | Genera audio ambientale coerente. |
| shot_type | No | string | customize | customize, intelligent | Modalità di montaggio: intelligent gestisce automaticamente ritmo e struttura; customize segue il prompt con precisione. |
| multi_prompt | No | array | — | Elenco di segmenti | Segmenti concatenati opzionali per le transizioni. |
| element_list | No | array | — | Elenco di riferimenti | Elementi visivi nominati da mantenere coerenti. |
La tariffa per secondo è fissa su RunComfy e non cambia con l’audio.
| Modalità | Tariffa al secondo |
|---|---|
| Audio attivo o disattivo | $0.42 |
Costo stimato per generazione
| Durata | Costo |
|---|---|
| 3 s | $1.26 |
| 5 s | $2.10 |
| 10 s | $4.20 |
| 15 s | $6.30 |
Genera video cinematografici con movimenti di camera e template AI
Genera un video da una traccia audio e un’immagine, con prompt e seed facoltativi.
Modifica un video di riferimento con un prompt e riferimenti facoltativi a elementi o immagini, scegliendo se mantenere l’audio originale.
Genera un video di 5 o 8 secondi da un prompt obbligatorio, con prompt negativo facoltativo, quattro dimensioni di output precise e controllo del seed.
Seedance 2.5 Reference to Video: crea video cinematografici con l’IA a partire da riferimenti
Trasforma immagini statiche in clip animate fluide con controllo dell'audio.
È il modello O3 4K di Kuaishou guidato da una singola immagine, ottimizzato per clip cinematografiche da 3 a 15 secondi con movimento fisicamente realistico. È ideale per animazione fotografica, reel prodotto premium e spot social verticali in cui contano dettaglio 4K e fedeltà al soggetto.
Punta alla massima risoluzione e al dettaglio finale della gamma image-to-video O3. Pro produce output HD a un prezzo inferiore, mentre Standard costa ancora meno ed è pensato per bozze e grandi volumi, secondo le informazioni pubbliche.
Sì. Puoi aggiungere un end_image al fotogramma iniziale per vincolare l’arco del movimento e definire con precisione il punto di arrivo. Usare sia immagine iniziale sia finale migliora nettamente la direzione del movimento e la coerenza narrativa.
Sì. L’opzione sound genera audio ambientale coerente nello stesso passaggio. È disattivata per impostazione predefinita e il prezzo resta uguale; attivarla è quindi utile per fuoco, acqua e scene ricche di atmosfera.
Supporta durate da 3 a 15 secondi in incrementi di un secondo, con 5 secondi predefiniti. È consigliabile verificare il movimento con una durata breve prima di un rendering più lungo. Consulta il pannello RunComfy per i limiti aggiornati.
Mantiene composizione, caratteristiche del personaggio e stile del fotogramma iniziale lungo tutta la clip: è il principale vantaggio del flusso image-to-video rispetto al puro text-to-video. Un’immagine pulita e ben composta, con un eventuale fotogramma finale, offre la maggiore coerenza.
image e prompt sono obbligatori; end_image, duration, sound, shot_type, multi_prompt ed element_list sono facoltativi. Gli URL devono essere pubblicamente accessibili. I limiti possono variare per modalità o provider: consulta il pannello RunComfy.
Sì. Prototipa nell’interfaccia RunComfy e poi richiama lo stesso modello dal backend tramite un’API HTTP con parametri identici, senza gestire hosting, GPU o scalabilità.
La tariffa fissa è $0.42 per secondo di video, indipendentemente dall’audio. Una clip di 5 secondi costa circa $2.10 e una di 15 secondi circa $6.30. Il costo viene detratto dal saldo in USD/crediti RunComfy e i nuovi utenti ricevono in genere un importo di prova.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





