Trasformazione video basata sull'AI con movimento stabile e controllo creativo.
È il modello text-to-video di punta della generazione O3 di Kuaishou, ottimizzato per la fedeltà del rendering finale. Da una sola descrizione scritta genera una clip da 5 o 10 secondi con movimento fisicamente realistico, inquadratura controllata e una traccia audio coerente opzionale.
È adatto ai team che vogliono filmati di livello broadcast dal linguaggio naturale, senza giornata di riprese, compositing o hosting del modello.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| prompt* | Sì (*) | string | — | Testo libero | Descrizione di soggetto, azione, camera, illuminazione e atmosfera. |
| aspect_ratio | No | string | 16:9 | 16:9, 9:16, 1:1 | Proporzioni del fotogramma in uscita. |
| duration | No | integer | 5 | 5, 10 | Durata della clip in secondi; il prezzo cresce linearmente. |
| sound | No | boolean | false | true / false | Genera audio sincronizzato con il video. |
| shot_type | No | string | customize | customize, intelligent | Modalità di montaggio: intelligent gestisce automaticamente ritmo e struttura; customize segue il prompt con precisione. |
| multi_prompt | No | array | [] | Fino a 20 segmenti | Segmenti aggiuntivi con durata propria per guidare le transizioni. |
| element_list | No | array | [] | Fino a 7 ID | ID di Kling Elements da mantenere coerenti lungo la clip. |
Kling Video O3 Pro Text To Video viene fatturato per secondo di output generato su RunComfy. L’audio aumenta di circa il 25% la tariffa per secondo.
| Modalità | Tariffa al secondo |
|---|---|
| Senza audio | $0.112 |
| Con audio | $0.140 |
Costo stimato per generazione
| Durata | Senza audio | Con audio |
|---|---|---|
| 5 s | $0.56 | $0.70 |
| 10 s | $1.12 | $1.40 |
Trasformazione video basata sull'AI con movimento stabile e controllo creativo.
Anima con Pikaframes la transizione tra un’immagine iniziale e una finale.
Modello video AI multimodale con audio nativo per input testuali, immagini e riferimenti.
Trasformazione video efficiente con movimento cinematografico e precisione del design.
Crea un breve video con audio sincronizzato da immagini di riferimento e un prompt.
Converti testi in video dinamici con l'intelligenza artificiale.
È il modello text-to-video di punta di Kuaishou, ottimizzato per rendering cinematografici da 5 o 10 secondi a partire da un prompt. È ideale per film di punta per i brand, spot social premium e concept reel in cui contano movimento fisicamente realistico, illuminazione controllata e composizione di livello broadcast.
Kling Video O3 Pro Text To Video punta alla fedeltà più alta della famiglia O3, con maggior dettaglio, coerenza del movimento e controllo della luce per rendering finali. In base alle informazioni pubbliche, Standard costa meno al secondo ed è pensato per bozze e iterazioni ad alto volume.
Sì. L’opzione sound genera nello stesso passaggio audio ambientale ed effetti coerenti. È disattivata per impostazione predefinita e, se attiva, aumenta di circa il 25% la tariffa al secondo.
Interpreta bene prompt strutturati: soggetto, azione, movimento di camera, stile di illuminazione e atmosfera influenzano il risultato. Usa segmenti multi-prompt per far evolvere la scena e un elenco di elementi per mantenere coerenti personaggi, oggetti o stili.
Supporta 16:9, 9:16 e 1:1 per cinema, social verticali e formati quadrati. La durata è di 5 o 10 secondi e il prezzo cresce linearmente. Verifica sempre i limiti aggiornati nel pannello parametri RunComfy.
Solo il prompt è obbligatorio; aspect_ratio, duration, sound, shot_type, multi-prompt ed element_list sono facoltativi. Rispetta le politiche d’uso dei contenuti di Kuaishou e controlla nel pannello RunComfy gli eventuali limiti applicati dal provider.
Sì. Puoi creare e perfezionare il risultato nell’interfaccia del modello RunComfy, quindi richiamare lo stesso modello dal backend tramite un’API HTTP con parametri identici. Non devi gestire GPU, hosting o scalabilità.
La tariffa è $0.112 per secondo senza audio e $0.140 per secondo con audio. Una clip muta di 5 secondi costa $0.56, mentre una clip di 10 secondi con audio costa $1.40. Il costo viene detratto dal saldo in USD/crediti RunComfy e i nuovi utenti ricevono in genere un importo di prova.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





