Animare un primo fotogramma obbligatorio da un prompt testuale, facoltativamente guidando la fine con un'immagine dell'ultimo fotogramma.
Wan 3.0 Text To Video legge una descrizione in linguaggio semplice e restituisce un breve clip cinematografico. Descrivi il soggetto, l'azione, la telecamera e la luce; il modello compone la ripresa, guida il movimento e può aggiungere l'audio corrispondente in un unico passaggio.
Questa pagina copre l'endpoint di solo testo della famiglia Wan 3.0. Non c'è alcuna immagine da caricare, quindi è un modo veloce per esplorare un'idea, bloccare una scena o produrre un cortometraggio finito utilizzando solo le parole.
| Parametro | Obbligatorio | Digitare | Predefinito | Gamma / Opzioni | Descrizione |
|---|---|---|---|---|---|
| richiesta* | Sì (*) | stringa | - | - | Scena, soggetto, azione, telecamera, illuminazione e movimento. |
| risoluzione | No | stringa | 720p | 480p, 720p, 1080p | Livello di risoluzione dell'output. |
| aspect_ratio | No | stringa | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, adaptive | Proporzioni di uscita. |
| durata | No | intero | 5 | 2-30 | Durata dell'output in secondi. |
| enable_audio | No | booleano | vero | vero/falso | Includere una traccia audio sincronizzata. |
| seme | No | intero | casuale | 0-2147483647 | Seme per risultati riproducibili. |
Il prezzo dipende dalla risoluzione scelta: 0,06 $ al secondo a 480p, 0,12 $ al secondo a 720p e 0,25 $ al secondo a 1080p. L'attivazione o la disattivazione dell'audio non modifica la velocità.
Animare un primo fotogramma obbligatorio da un prompt testuale, facoltativamente guidando la fine con un'immagine dell'ultimo fotogramma.
HappyHorse 1.0 I2V su Alibaba anima un'immagine fissa in un video nativo a 1080p con movimenti fisicamente accurati e soggetti con identità stabile.
Estendi una traccia audio all'inizio, alla fine o in entrambe le direzioni mantenendone lo stile.
Trasforma immagini in video realistici con movimenti fluidi e dettagli nitidi.
MiniMax H3: testo-video 768p/2K con audio stereo nativo
Strumento di conversione del movimento basato sull'intelligenza artificiale che consente la creazione di animazioni precise e stabili
Wan 3.0 Text To Video genera una breve clip cinematografica direttamente da un messaggio scritto, senza che sia richiesta un'immagine di riferimento. È utile per la previsualizzazione di concetti, scatti pubblicitari e promozionali e video social, consentendoti di visualizzare un'idea in pochi minuti solo a parole.
L'endpoint da testo a video inizia solo da un prompt, quindi il modello compone l'intera scena, mentre l'endpoint da immagine a video anima un primo fotogramma specifico fornito. Scegli Wan 3.0 Text To Video quando vuoi che sia la modella a inventare l'inquadratura e trasforma l'immagine in video quando hai già l'inquadratura iniziale.
Wan 3.0 Text To Video segue istruzioni strutturate che denominano il soggetto, l'azione, il movimento della telecamera e l'illuminazione e produce un movimento coerente, simile a quello di un film. Suggerimenti chiari e concreti con una singola direzione della telecamera per inquadratura generalmente danno i risultati più prevedibili.
Supporta output 480p, 720p e 1080p, durata da 2 a 30 secondi e proporzioni tra cui 16:9, 9:16, 1:1, 4:3 e 3:4. Utilizza 480p per bozze veloci e 1080p per la consegna; controlla il pannello RunComfy per i limiti di corrente esatti.
SÌ. Wan 3.0 Text To Video può generare una traccia audio sincronizzata con il video e puoi disabilitare l'audio per un'esportazione silenziosa. L'attivazione o la disattivazione dell'audio non influisce sul prezzo.
La modalità di pensiero consente un'interpretazione più deliberata del suggerimento, il che può essere utile quando una scena combina diverse azioni, soggetti o regole di composizione. È facoltativo e disattivato per impostazione predefinita, quindi puoi abilitarlo per prompt complessi e lasciarlo disattivato per quelli semplici.
SÌ. Puoi prototipare Wan 3.0 Text To Video nell'interfaccia utente del modello RunComfy e quindi richiamare lo stesso modello tramite RunComfy HTTP API con gli stessi parametri. Ciò semplifica il passaggio dal test del browser a un flusso di lavoro di produzione automatizzato.
Le generazioni consumano usd o crediti in base alla risoluzione e alla durata: 0,06 $ al secondo a 480p, 0,12 $ al secondo a 720p e 0,25 $ al secondo a 1080p. I nuovi utenti di solito ricevono un importo di prova gratuito per testare prima Wan 3.0 Text To Video.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





