Trasforma regioni video con maschere, testo o immagini di riferimento.
È il modello 4K della famiglia O3 di Kuaishou guidato dai riferimenti, ottimizzato per il rendering finale e per mantenere stabile il soggetto lungo l’intera ripresa. Fornisci fino a sette immagini (o quattro insieme a un video di riferimento) e una descrizione per ottenere una clip 4K da 3 a 15 secondi con movimento fisicamente realistico e audio opzionale.
È pensato per filmati 4K di livello broadcast con una persona, un prodotto o uno stile preciso, senza riprese, rotoscoping manuale o GPU proprie.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| prompt* | Sì (*) | string | — | Testo libero | Scena, soggetto, azione, camera e illuminazione. |
| images | No | array di URL | — | Fino a 7 senza video, fino a 4 con video | Immagini che vincolano identità e stile. |
| aspect_ratio | No | string | 16:9 | 16:9, 9:16, 1:1 | Proporzioni del fotogramma. |
| duration | No | integer | 5 | Da 3 a 15 | Durata in secondi; il prezzo cresce linearmente. |
| sound | No | boolean | false | true / false | Genera audio coerente, solo senza video di riferimento. |
| shot_type | No | string | customize | customize, intelligent | Modalità di montaggio: intelligent gestisce automaticamente ritmo e struttura; customize segue il prompt con precisione. |
Trasforma regioni video con maschere, testo o immagini di riferimento.
Video realistici da testo o immagine con controllo creativo totale.
Trasforma foto in video realistici con sincronizzazione labiale naturale
Crea video di alta qualità da testi con Google Veo 3 e la sua IA avanzata.
Animazioni AI di alta qualità, controllo in tempo reale e effetti pro
Crea video realistici e fluidi da due immagini con transizioni perfette
È il modello O3 4K di Kuaishou guidato da riferimenti, ottimizzato per clip cinematografiche da 3 a 15 secondi che mantengono l’identità del soggetto. È ideale per film di brand basati sui personaggi, reel prodotto premium e spot con protagonisti visivamente coerenti, dove contano movimento fisicamente realistico e dettaglio 4K.
Punta alla massima risoluzione e al dettaglio finale della gamma reference-to-video O3. Pro produce output HD a un prezzo inferiore, mentre Standard costa ancora meno ed è pensato per bozze e grandi volumi, secondo le informazioni pubbliche.
Accetta fino a sette immagini quando non viene fornito un video di riferimento e fino a quattro quando viene usato anche un video. Riferimenti nitidi da angolazioni diverse migliorano in genere la conservazione dell’identità.
Sì. Quando non è presente un video di riferimento, l’opzione sound può creare audio ambientale nello stesso passaggio. È disattivata per impostazione predefinita e il prezzo resta uguale con o senza audio.
Supporta 16:9, 9:16 e 1:1 per cinema, social verticali e quadrato. La durata va da 3 a 15 secondi in incrementi di un secondo. Verifica i limiti aggiornati nel pannello RunComfy.
Estrae le caratteristiche del soggetto da più punti di vista e le propaga lungo tutti i fotogrammi: è il principale vantaggio del flusso reference-to-video rispetto al puro text-to-video. Riferimenti nitidi, ben illuminati e da angolazioni diverse offrono la maggiore coerenza.
Solo il prompt è obbligatorio; images, aspect_ratio, duration, sound, shot_type, multi-prompt ed element_list sono facoltativi. Gli URL devono essere pubblicamente accessibili. I limiti possono variare per modalità o provider: consulta il pannello RunComfy.
Sì. Prototipa nell’interfaccia RunComfy e poi richiama lo stesso modello dal backend tramite un’API HTTP con parametri identici, senza gestire hosting, GPU o scalabilità.
La tariffa fissa è $0.42 per secondo di video, indipendentemente dall’audio. Una clip di 5 secondi costa circa $2.10 e una di 15 secondi circa $6.30. Il costo viene detratto dal saldo in USD/crediti RunComfy e i nuovi utenti ricevono in genere un importo di prova.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





