Trasforma una clip sorgente tramite prompt testuale, con audio nativo.
È il modello della famiglia O3 di Kuaishou per la generazione guidata da riferimenti. Crea nuove clip preservando l'identità di persone, oggetti o stili forniti come riferimento. Il livello Standard offre un prezzo accessibile e mantiene l'estetica O3 lungo l'intero intervallo da 3 a 15 secondi.
È pensato per i team che desiderano video brevi con personaggi, elementi del brand o direzioni artistiche precise, senza riprese, green screen o rotoscoping manuale.
Trasforma una clip sorgente tramite prompt testuale, con audio nativo.
Generazione cinematografica 4K da riferimenti a $0.42 per secondo di output.
Trasforma immagini e testi in video HD realistici con facilità.
Crea video realistici e di alta qualità da testo con Kling 2.5 Turbo.
Controllo visivo avanzato per video realistici e animazioni fluide
Trasforma immagini in video realistici con audio sincronizzato.
Kling Video O3 Standard Reference to Video è il modello della famiglia O3 di Kuaishou guidato da riferimenti. Genera da un prompt un video di 3–15 secondi preservando l'identità di persone, oggetti o stili forniti come immagini; un video opzionale può guidare movimento o stile. L'output mantiene personaggi e resa coerenti tra i fotogrammi senza mascherature o compositing manuali.
Puoi allegare immagini di personaggi, oggetti o stili artistici e un video opzionale per movimento o trasferimento di stile. Senza video sono supportate fino a 7 immagini; con un video il limite scende a 4. Nel prompt indica le immagini per posizione, ad esempio "Figure 1 walks toward Figure 2", affinché Kling Video O3 Standard Reference to Video sappia quale soggetto inserire in ogni ruolo.
Rispetto al livello Pro, Kling Video O3 Standard Reference to Video offre una tariffa al secondo inferiore mantenendo il linguaggio visivo O3, utile per iterazioni e contenuti social o marketing in volume. Secondo le informazioni disponibili, Pro è destinato alla massima fedeltà dei rendering finali, mentre Standard è adatto a bozze, varianti e contenuti brevi. I controlli — prompt, riferimenti, proporzioni, durata, audio e tipo di inquadratura — sono uguali, quindi i prompt si trasferiscono facilmente.
Creator, team pubblicitari e marketing, produttori video e-commerce e studi di design usano Kling Video O3 Standard Reference to Video per creare da foto esistenti varianti con personaggi coerenti, ambienti, oggetti o atmosfere diversi senza nuove riprese. È adatto anche a clip con portavoce di brand, concept reel e scene narrative con più personaggi. Gli sviluppatori possono integrarlo in pipeline che trasformano un brief e poche immagini in un breve video finito.
Il prompt è obbligatorio; immagini e video di riferimento sono opzionali ma consigliati. Kling Video O3 Standard Reference to Video accetta fino a 7 immagini, o 4 insieme a un video; aspect_ratio accetta 16:9, 9:16 o 1:1, duration è un intero da 3 a 15 secondi e shot_type accetta customize o intelligent. sound e keep_original_sound sono booleani. Per risoluzione, formati e altri limiti, consulta il pannello RunComfy.
Sì. Prova Kling Video O3 Standard Reference to Video nella Web UI del RunComfy AI Playground e regola riferimenti, prompt, proporzioni, durata e audio. Poi richiama lo stesso modello tramite l'API RunComfy con parametri identici. L'iterazione resta nel browser e la produzione nel codice, senza cambiare il comportamento del modello.
Le generazioni consumano crediti USD dal saldo RunComfy. Kling Video O3 Standard Reference to Video costa $0.084 al secondo senza audio e $0.112 al secondo con audio; un video di riferimento applica invece una tariffa 1.5× di $0.126 al secondo e sostituisce il moltiplicatore audio. Per esempio, 5 secondi senza audio costano circa $0.420, 10 secondi con audio circa $1.120 e 15 secondi con un video di riferimento circa $1.890. Consulta la sezione Generation per le tariffe aggiornate.
Kling Video O3 Standard Reference to Video risponde meglio a prompt chiari che assegnano ruoli ai riferimenti tramite "Figure 1", "Figure 2" e così via, per poi descrivere azione, ambiente e movimento della camera. Indicazioni concrete come "slow tracking shot", "golden hour rim light" o "neon-lit street" definiscono resa e movimento meglio di parole generiche. Per scene complesse, usa segmenti multi_prompt per separare i momenti e mantenere pulite le transizioni.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





