Genera un video 16:9 da un’immagine e un prompt, scegliendo durata, risoluzione, frame rate e audio facoltativo.
Seedance 2.0 Pro è un modello multimodale text-to-video di ByteDance Seed che trasforma descrizioni di scena e riferimenti opzionali in brevi clip cinematografiche. Su RunComfy la generazione parte da un prompt, con immagini (fino a 9), video (fino a 3) e audio (fino a 3) opzionali. Puoi impostare proporzioni, durata, risoluzione, generazione audio, seed e strumenti facoltativi, ad esempio '[{ "type": "web_search" }]' per consentire ricerche online quando il modello lo ritiene utile.
Output di questo playground: 480p / 720p / 1080p / 4K selezionabili · 4–15 secondi · proporzioni adaptive (predefinito), 16:9, 9:16, 4:3, 3:4, 1:1, 21:9 · audio nativo opzionale quando Generate audio è attivo
Gli input corrispondono allo schema OpenAPI Input di questo template RunComfy.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| prompt* | Sì (*) | string | — | CN ~≤500 caratteri, EN ~≤1000 parole consigliate | Prompt testuale del video |
| image_url (Images) | No | array (URI immagini) | [] | 0–9 | jpeg, png, webp, bmp, tiff, gif |
| video_url (Videos) | No | array (URI video) | [] | 0–3 | mp4, mov; durata 2–15 s per clip |
| audio_url (Audio URLs) | No | array (URI audio) | [] | 0–3 | wav, mp3; 2–15 s, < 15 MB |
| aspect_ratio | No | string | adaptive | adaptive, 16:9, 9:16, 4:3, 3:4, 1:1, 21:9 | Il modello sceglie il rapporto più vicino; controlla il risultato effettivo |
| duration | No | integer | 5 | 4–15 secondi | Durata intera della clip |
| resolution | No | string | 720p | 480p, 720p, 1080p, 4k | Preset della risoluzione in uscita |
| generate_audio | No | boolean | true | true / false | Quando true, crea audio sincronizzato (voce, SFX, musica) |
| seed | No | integer | — | — | Seed casuale per la generazione |
| tools | No | array di oggetti | [] | solo 'type': web_search | Dichiara gli strumenti consentiti; controlla 'usage.tool_usage.web_search' nella query |
1) Descrivi la scena — Specifica soggetto, azione, ambiente, atmosfera, luce e camera. Sono consigliati circa ≤500 caratteri in cinese o ≤1000 parole in inglese.
2) Aggiungi riferimenti facoltativi — Carica immagini per look o identità e brevi video o audio rispettandone durata e dimensione.
3) Scegli le proporzioni — Usa adaptive per esplorare, oppure un formato fisso come 9:16 o 16:9 per un output preciso.
4) Imposta la durata — Qualsiasi numero intero da 4 a 15 secondi.
5) Scegli la risoluzione — 480p per bozze rapide, 720p per il miglior equilibrio, 1080p per più dettaglio o 4K per la massima nitidezza.
6) Genera audio — Lascialo attivo per dialoghi, SFX o musica; disattivalo per un video muto.
7) Seed opzionale — Mantieni fisso il seed per attribuire le variazioni al prompt o ai media, non alla casualità.
8) Ricerca web opzionale — Aggiungi tools '[{ "type": "web_search" }]' per consentire ricerche aggiornate; al termine leggi 'usage.tool_usage.web_search' nella query dell’attività.
9) Genera e perfeziona — Modifica le parole, sostituisci i riferimenti o regola proporzioni, durata e risoluzione.
In breve, Seedance 2.0 Pro su RunComfy supporta testo, fino a nove immagini, tre video e tre audio di riferimento, clip da 4–15 s, preset 480p–4K, proporzioni flessibili incluso adaptive e audio nativo opzionale, in linea con i campi del playground.
Genera un video 16:9 da un’immagine e un prompt, scegliendo durata, risoluzione, frame rate e audio facoltativo.
Sincronizza una traccia audio con un video e scegli se il video deve essere ripetuto.
Generazione cinematografica text-to-video in 4K a $0.47 per secondo di output.
Conversione da immagine a video a pesi aperti con ultimo fotogramma opzionale e audio stereo nativo.
Crea un video animato da un’immagine di riferimento e un video sorgente, scegliendo dimensioni di output e seed.
Genera un video da una traccia audio e un’immagine, con prompt e seed facoltativi.
In questo playground la risoluzione può essere 480p, 720p (predefinita), 1080p o 4K. Le proporzioni possono essere adaptive (predefinito: il modello sceglie il rapporto più vicino e il risultato dell’attività riporta quello effettivo) oppure fisse: 16:9, 9:16, 4:3, 3:4, 1:1 o 21:9.
Per il prompt sono consigliati circa ≤500 caratteri in cinese o ≤1000 parole in inglese. Puoi usare fino a 9 immagini (jpeg, png, webp, bmp, tiff, gif), 3 video (mp4, mov) da 2–15 secondi ciascuno e 3 file audio (wav, mp3), ciascuno da 2–15 secondi e meno di 15 MB. Solo il prompt è obbligatorio.
Usa l’API RunComfy con gli stessi campi Input del playground: prompt, image_url, video_url, audio_url, aspect_ratio, duration, resolution, generate_audio e seed. Verifica prompt e limiti dei media nell’interfaccia, quindi usa chiave API e crediti del tuo account per automatizzare i processi.
Punta a brevi clip cinematografiche con riferimenti multimodali, controllo della durata da 4–15 secondi, proporzioni flessibili incluso adaptive e audio nativo quando generate_audio è attivo, utile per lip-sync, SFX e musica sincronizzati. I benchmark dipendono dai contenuti: confronta risultati con gli stessi prompt e riferimenti.
La scelta dipende dal flusso di lavoro. Questo template offre fino a nove immagini, tre video, tre audio, preset 480p–4K e audio generato attivabile. Wan 2.5 e Kling 2.6 hanno prezzi, limiti e punti di forza diversi: provali in parallelo sui tuoi prompt e riferimenti tipici.
Sì. Immagini di riferimento, eventuali video o audio e un prompt chiaro aiutano a vincolare identità, abbigliamento e tono. Lo schema API non documenta una sintassi speciale “@”: la coerenza nasce dall’allineamento tra testo e media nei limiti supportati.
Quando Generate audio (generate_audio) è true, per impostazione predefinita il modello produce video con audio sincronizzato — voce, SFX e musica. Impostalo su false per un video muto. La qualità del lip-sync dipende comunque dalla chiarezza del prompt e dalla scena.
Duration è un numero intero da 4 a 15 secondi, con 5 predefinito. Puoi scegliere qualsiasi valore intero nell’intervallo per ogni generazione.
L’uso commerciale dipende dalla licenza del modello di ByteDance e dai termini di servizio RunComfy. Consulta licenza e documentazione ufficiali o contatta hi@runcomfy.com prima di usare i video in campagne a pagamento o distribuzioni pubbliche.
Team e creator che vogliono brevi clip cinematografiche con riferimenti opzionali a immagini, video e audio, proporzioni per diverse piattaforme, esportazione fino a 4K e audio integrato: annunci, social video, previsualizzazione e test narrativi di brand.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





