Trasforma foto in video realistici con sincronizzazione labiale naturale
È il modello text-to-video di punta della generazione O3 di Kuaishou, ottimizzato per la fedeltà del rendering finale. Da una sola descrizione scritta genera una clip da 5 o 10 secondi con movimento fisicamente realistico, inquadratura controllata e una traccia audio coerente opzionale.
È adatto ai team che vogliono filmati di livello broadcast dal linguaggio naturale, senza giornata di riprese, compositing o hosting del modello.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| prompt* | Sì (*) | string | — | Testo libero | Descrizione di soggetto, azione, camera, illuminazione e atmosfera. |
| aspect_ratio | No | string | 16:9 | 16:9, 9:16, 1:1 | Proporzioni del fotogramma in uscita. |
| duration | No | integer | 5 | 5, 10 | Durata della clip in secondi; il prezzo cresce linearmente. |
| sound | No | boolean | false | true / false | Genera audio sincronizzato con il video. |
| shot_type | No | string | customize | customize, intelligent | Modalità di montaggio: intelligent gestisce automaticamente ritmo e struttura; customize segue il prompt con precisione. |
| multi_prompt | No | array | [] | Fino a 20 segmenti | Segmenti aggiuntivi con durata propria per guidare le transizioni. |
| element_list | No | array | [] | Fino a 7 ID | ID di Kling Elements da mantenere coerenti lungo la clip. |
Kling Video O3 Pro Text To Video viene fatturato per secondo di output generato su RunComfy. L’audio aumenta di circa il 25% la tariffa per secondo.
| Modalità | Tariffa al secondo |
|---|---|
| Senza audio | $0.112 |
| Con audio | $0.140 |
Costo stimato per generazione
| Durata | Senza audio | Con audio |
|---|---|---|
| 5 s | $0.56 | $0.70 |
| 10 s | $1.12 | $1.40 |
Trasforma foto in video realistici con sincronizzazione labiale naturale
Anima una foto statica in un video fluido a 720P o 1080P partendo da un solo prompt.
Anima un'immagine iniziale in una clip cinematografica con audio nativo.
Crea video realistici in pochi secondi con Dreamina 3.0, ideale per designer creativi.
Trasforma immagini in video fluidi con scene naturali e movimento coerente.
Trasforma una clip sorgente tramite prompt testuale, con audio nativo.
È il modello text-to-video di punta di Kuaishou, ottimizzato per rendering cinematografici da 5 o 10 secondi a partire da un prompt. È ideale per film di punta per i brand, spot social premium e concept reel in cui contano movimento fisicamente realistico, illuminazione controllata e composizione di livello broadcast.
Kling Video O3 Pro Text To Video punta alla fedeltà più alta della famiglia O3, con maggior dettaglio, coerenza del movimento e controllo della luce per rendering finali. In base alle informazioni pubbliche, Standard costa meno al secondo ed è pensato per bozze e iterazioni ad alto volume.
Sì. L’opzione sound genera nello stesso passaggio audio ambientale ed effetti coerenti. È disattivata per impostazione predefinita e, se attiva, aumenta di circa il 25% la tariffa al secondo.
Interpreta bene prompt strutturati: soggetto, azione, movimento di camera, stile di illuminazione e atmosfera influenzano il risultato. Usa segmenti multi-prompt per far evolvere la scena e un elenco di elementi per mantenere coerenti personaggi, oggetti o stili.
Supporta 16:9, 9:16 e 1:1 per cinema, social verticali e formati quadrati. La durata è di 5 o 10 secondi e il prezzo cresce linearmente. Verifica sempre i limiti aggiornati nel pannello parametri RunComfy.
Solo il prompt è obbligatorio; aspect_ratio, duration, sound, shot_type, multi-prompt ed element_list sono facoltativi. Rispetta le politiche d’uso dei contenuti di Kuaishou e controlla nel pannello RunComfy gli eventuali limiti applicati dal provider.
Sì. Puoi creare e perfezionare il risultato nell’interfaccia del modello RunComfy, quindi richiamare lo stesso modello dal backend tramite un’API HTTP con parametri identici. Non devi gestire GPU, hosting o scalabilità.
La tariffa è $0.112 per secondo senza audio e $0.140 per secondo con audio. Una clip muta di 5 secondi costa $0.56, mentre una clip di 10 secondi con audio costa $1.40. Il costo viene detratto dal saldo in USD/crediti RunComfy e i nuovi utenti ricevono in genere un importo di prova.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





