Genera video multi-clip diretti da prompt con audio opzionale.
PixVerse 5.5 Text-to-Video utilizza un prompt richiesto per generare un video. I suoi controlli definiscono l'inquadratura, la risoluzione, la lunghezza, le esclusioni, lo stile visivo, il seed casuale, l'audio, il comportamento multi-clip e l'ottimizzazione del prompt.
| Parametro | Obbligatorio | Predefinito/scelte | Cosa controlla |
|---|---|---|---|
prompt | Sì | Prompt di esempio | Soggetto, ambientazione, azione, comportamento della telecamera, ritmo e dettagli visivi. |
aspect_ratio | No | Predefinito 16:9 | Valori esatti: 16:9, 4:3, 1:1, 3:4, 9:16. |
resolution | No | Predefinito 720p | Valori esatti: 360p, 540p, 720p, 1080p. |
duration | No | Predefinito 5 | Valori esatti: 5, 8 o 10 secondi. A 1080p, utilizza 5 o 8 secondi. |
negative_prompt | No | Vuoto | Elementi, stili o artefatti da evitare. |
style | No | Predefinito anime | Valori esatti: anime, 3d_animation, clay, comic, cyberpunk. |
seed | No | Predefinito 0 | Seme intero per iterazioni comparabili o ripetibili; non è documentato alcun minimo o massimo. |
generate_audio_switch | No | Predefinito false | Abilita musica di sottofondo, effetti sonori o generazione di dialoghi. |
generate_multi_clip_switch | No | Predefinito false | Abilita più clip con modifiche dinamiche della telecamera. |
thinking_type | No | Predefinito auto | Valori esatti: enabled, disabled, auto. |
prompt, indica il soggetto, l'ambientazione, l'azione, il comportamento della telecamera, il ritmo e lo stile visivo.aspect_ratio, resolution e duration; ricorda che 1080p supporta solo 5 o 8 secondi.negative_prompt focalizzato, scegli un style e mantieni fisso seed mentre confronti le impostazioni.generate_audio_switch solo quando si desidera l'audio e attiva generate_multi_clip_switch quando sono necessari cambiamenti dinamici della telecamera o più clip.thinking_type come auto, enabled o disabled in base al comportamento di ottimizzazione desiderato.false per impostazione predefinita; nessuno dei due è automatico.duration accetta 10 secondi a risoluzioni inferiori, ma non a 1080p.Genera video multi-clip diretti da prompt con audio opzionale.
Image-to-video premium con la massima fedeltà visiva e il movimento più realistico della famiglia Kling V3.0.
Genera un video da un'immagine ritratto richiesta e una traccia audio richiesta di durata inferiore a 35 secondi. Aggiungi indicazioni facoltative in sei lingue supportate e utilizza il controllo seed, il cui valore predefinito è -1.
Estendi una traccia audio all'inizio, alla fine o in entrambe le direzioni mantenendone lo stile.
Converti testi in video dinamici con l'intelligenza artificiale.
Trasforma un ritratto e una traccia audio in un video con avatar parlante, con un prompt opzionale di movimento o indicazioni sul modo di parlare.
È una pagina video basata su testo che richiede prompt. Fornisce inoltre i controlli aspect_ratio, resolution, duration, negative_prompt, style, seed, generate_audio_switch, generate_multi_clip_switch e thinking_type.
aspect_ratio supporta esattamente 16:9, 4:3, 1:1, 3:4 e 9:16. resolution supporta esattamente 360p, 540p, 720p e 1080p.
duration supporta 5, 8 o 10 secondi. Quando resolution è 1080p, sono consentiti solo 5 o 8 secondi.
No. generate_audio_switch per impostazione predefinita è false. Impostalo su true per richiedere musica di sottofondo, effetti sonori o dialoghi; lo schema non garantisce la sincronizzazione labiale o un formato audio specifico.
generate_multi_clip_switch predefinito è false. Abilitalo per richiedere più clip con modifiche dinamiche della telecamera. Lo schema non indica il conteggio delle clip né garantisce la continuità narrativa.
style supporta anime, 3d_animation, clay, comic e cyberpunk. thinking_type supporta enabled, disabled e auto, con auto come predefinito.
RunComfy gestisce l'utilizzo tramite il suo attuale sistema di crediti. Controllare il pannello di generazione o l'ultima documentazione di fatturazione per il requisito di credito applicabile; lo schema non garantisce crediti di prova gratuiti.
No. Questa è una pagina di testo in video senza campo image_url o immagine di riferimento. Utilizza il modello immagine-video correlato quando è richiesto un flusso di lavoro basato su immagini.
La pagina non ha dimensioni personalizzate, frequenza fotogrammi, formato di output, input di immagini o campi di controllo della fotocamera dedicati. L'output di dieci secondi non è disponibile su 1080p, i controlli audio e multi-clip sono disattivati per impostazione predefinita e lo schema non fornisce garanzie formali di qualità.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





