Genera un video da una traccia audio e un’immagine, con prompt e seed facoltativi.
Wan 3.0 Text To Video legge una descrizione in linguaggio semplice e restituisce un breve clip cinematografico. Descrivi il soggetto, l'azione, la telecamera e la luce; il modello compone la ripresa, guida il movimento e può aggiungere l'audio corrispondente in un unico passaggio.
Questa pagina copre l'endpoint di solo testo della famiglia Wan 3.0. Non c'è alcuna immagine da caricare, quindi è un modo veloce per esplorare un'idea, bloccare una scena o produrre un cortometraggio finito utilizzando solo le parole.
| Parametro | Obbligatorio | Digitare | Predefinito | Gamma / Opzioni | Descrizione |
|---|---|---|---|---|---|
| richiesta* | Sì (*) | stringa | - | - | Scena, soggetto, azione, telecamera, illuminazione e movimento. |
| risoluzione | No | stringa | 720p | 480p, 720p, 1080p | Livello di risoluzione dell'output. |
| aspect_ratio | No | stringa | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, adaptive | Proporzioni di uscita. |
| durata | No | intero | 5 | 2-30 | Durata dell'output in secondi. |
| thinking_mode | No | booleano | falso | vero/falso | Interpretazione più approfondita per istruzioni complesse. |
| enable_audio | No | booleano | vero | vero/falso | Includere una traccia audio sincronizzata. |
| seme | No | intero | casuale | 0-2147483647 | Seme per risultati riproducibili. |
Il prezzo dipende dalla risoluzione scelta: 0,06 $ al secondo a 480p, 0,12 $ al secondo a 720p e 0,25 $ al secondo a 1080p. L'attivazione o la disattivazione dell'audio non modifica la velocità.
Genera un video da una traccia audio e un’immagine, con prompt e seed facoltativi.
Anima un’immagine di riferimento con Sora 2 Pro tramite un prompt e scegli dimensioni e durata.
Anima immagini statiche in clip cinematografiche native 4K, con fotogrammi iniziale e finale come guida e audio sincronizzato.
Generazione cinematografica 4K da immagine a $0.42 per secondo di output.
Crea video realistici e fluidi da due immagini con transizioni perfette
MiniMax H3: testo-video 768p/2K con audio stereo nativo
Wan 3.0 Text To Video genera una breve clip cinematografica direttamente da un messaggio scritto, senza che sia richiesta un'immagine di riferimento. È utile per la previsualizzazione di concetti, scatti pubblicitari e promozionali e video social, consentendoti di visualizzare un'idea in pochi minuti solo a parole.
L'endpoint da testo a video inizia solo da un prompt, quindi il modello compone l'intera scena, mentre l'endpoint da immagine a video anima un primo fotogramma specifico fornito. Scegli Wan 3.0 Text To Video quando vuoi che sia la modella a inventare l'inquadratura e trasforma l'immagine in video quando hai già l'inquadratura iniziale.
Wan 3.0 Text To Video segue istruzioni strutturate che denominano il soggetto, l'azione, il movimento della telecamera e l'illuminazione e produce un movimento coerente, simile a quello di un film. Suggerimenti chiari e concreti con una singola direzione della telecamera per inquadratura generalmente danno i risultati più prevedibili.
Supporta output 480p, 720p e 1080p, durata da 2 a 30 secondi e proporzioni tra cui 16:9, 9:16, 1:1, 4:3 e 3:4. Utilizza 480p per bozze veloci e 1080p per la consegna; controlla il pannello RunComfy per i limiti di corrente esatti.
SÌ. Wan 3.0 Text To Video può generare una traccia audio sincronizzata con il video e puoi disabilitare l'audio per un'esportazione silenziosa. L'attivazione o la disattivazione dell'audio non influisce sul prezzo.
La modalità di pensiero consente un'interpretazione più deliberata del suggerimento, il che può essere utile quando una scena combina diverse azioni, soggetti o regole di composizione. È facoltativo e disattivato per impostazione predefinita, quindi puoi abilitarlo per prompt complessi e lasciarlo disattivato per quelli semplici.
SÌ. Puoi prototipare Wan 3.0 Text To Video nell'interfaccia utente del modello RunComfy e quindi richiamare lo stesso modello tramite RunComfy HTTP API con gli stessi parametri. Ciò semplifica il passaggio dal test del browser a un flusso di lavoro di produzione automatizzato.
Le generazioni consumano usd o crediti in base alla risoluzione e alla durata: 0,06 $ al secondo a 480p, 0,12 $ al secondo a 720p e 0,25 $ al secondo a 1080p. I nuovi utenti di solito ricevono un importo di prova gratuito per testare prima Wan 3.0 Text To Video.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





