Genera un video di 5 o 8 secondi da un prompt obbligatorio, con prompt negativo facoltativo, quattro dimensioni di output precise e controllo del seed.
prompt indica soggetto, azione, ambiente, luce, movimento di camera e, se utile, suoni o parlato.duration accetta esclusivamente 5 o 10 secondi; il valore predefinito è 5.aspect_ratio può essere 16:9, 9:16 o 1:1; l’impostazione predefinita è 16:9.negative_prompt specifichi elementi o difetti da evitare.generate_audio è attivo per impostazione predefinita. Supporta voci in cinese e inglese; le altre lingue vengono tradotte in inglese.prompt i suoni o le battute importanti.9:16 per il verticale, 16:9 per l’orizzontale o 1:1 per il quadrato.negative_prompt a problemi specifici, come sfocatura o deformazioni.Questo modello da testo a video non prevede un’immagine in ingresso. Per animare un’immagine esistente, usa Kling 2.6 Pro Image-to-Video.
Genera un video di 5 o 8 secondi da un prompt obbligatorio, con prompt negativo facoltativo, quattro dimensioni di output precise e controllo del seed.
Wan 3.0 trasforma l'immagine del primo fotogramma in un video cinematografico con audio
Anima un'immagine iniziale in una clip cinematografica con audio nativo.
Genera video cinematografici con audio sincronizzato a partire da un prompt.
Crea un video da un prompt e controlla LoRA, risoluzione, proporzioni, fotogrammi, FPS, passaggi e seed.
Trasforma immagini in video realistici con audio sincronizzato.
È un modello che crea un breve filmato direttamente dalla descrizione scritta di una scena. Questa variante non richiede un’immagine iniziale.
È obbligatorio solo prompt, in cui puoi descrivere soggetto, azione, ambiente e regia.
duration accetta esclusivamente 5 o 10 secondi. Per aspect_ratio puoi scegliere 16:9, 9:16 o 1:1.
generate_audio attiva o disattiva la generazione dell’audio nativo ed è attivo per impostazione predefinita. Supporta voci cinesi e inglesi; le altre lingue vengono tradotte in inglese.
Con negative_prompt indichi elementi o caratteristiche da evitare, per esempio sfocatura o deformazioni.
No. Lo schema di input di questa variante da testo a video non contiene un campo immagine. Per partire da un’immagine usa il modello da immagine a video.
Descrivi in modo concreto azione visibile, ambiente, illuminazione e camera. Con l’audio attivo puoi aggiungere suoni o contenuti parlati.
Le impostazioni iniziali sono duration = 5, aspect_ratio = 16:9 e generate_audio = true. Il prompt negativo parte da «blur, distort, and low quality».
Sì. Puoi eseguire il modello in RunComfy oppure integrarlo in un flusso tramite API HTTP.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





