Trasforma un'immagine di riferimento in un video di 5 o 10 secondi, con prompt negativo opzionale e generazione di audio nativo.
Seedance 2.0 Pro è un modello multimodale text-to-video di ByteDance Seed che trasforma descrizioni di scena e riferimenti opzionali in brevi clip cinematografiche. Su RunComfy la generazione parte da un prompt, con immagini (fino a 9), video (fino a 3) e audio (fino a 3) opzionali. Puoi impostare proporzioni, durata, risoluzione, generazione audio, seed e strumenti facoltativi, ad esempio '[{ "type": "web_search" }]' per consentire ricerche online quando il modello lo ritiene utile.
Output di questo playground: 480p / 720p / 1080p / 4K selezionabili · 4–15 secondi · proporzioni adaptive (predefinito), 16:9, 9:16, 4:3, 3:4, 1:1, 21:9 · audio nativo opzionale quando Generate audio è attivo
Gli input corrispondono allo schema OpenAPI Input di questo template RunComfy.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| prompt* | Sì (*) | string | — | CN ~≤500 caratteri, EN ~≤1000 parole consigliate | Prompt testuale del video |
| image_url (Images) | No | array (URI immagini) | [] | 0–9 | jpeg, png, webp, bmp, tiff, gif |
| video_url (Videos) | No | array (URI video) | [] | 0–3 | mp4, mov; durata 2–15 s per clip |
| audio_url (Audio URLs) | No | array (URI audio) | [] | 0–3 | wav, mp3; 2–15 s, < 15 MB |
| aspect_ratio | No | string | adaptive | adaptive, 16:9, 9:16, 4:3, 3:4, 1:1, 21:9 | Il modello sceglie il rapporto più vicino; controlla il risultato effettivo |
| duration | No | integer | 5 | 4–15 secondi | Durata intera della clip |
| resolution | No | string | 720p | 480p, 720p, 1080p, 4k | Preset della risoluzione in uscita |
| generate_audio | No | boolean | true | true / false | Quando true, crea audio sincronizzato (voce, SFX, musica) |
| seed | No | integer | — | — | Seed casuale per la generazione |
| tools | No | array di oggetti | [] | solo 'type': web_search | Dichiara gli strumenti consentiti; controlla 'usage.tool_usage.web_search' nella query |
1) Descrivi la scena — Specifica soggetto, azione, ambiente, atmosfera, luce e camera. Sono consigliati circa ≤500 caratteri in cinese o ≤1000 parole in inglese.
2) Aggiungi riferimenti facoltativi — Carica immagini per look o identità e brevi video o audio rispettandone durata e dimensione.
3) Scegli le proporzioni — Usa adaptive per esplorare, oppure un formato fisso come 9:16 o 16:9 per un output preciso.
4) Imposta la durata — Qualsiasi numero intero da 4 a 15 secondi.
5) Scegli la risoluzione — 480p per bozze rapide, 720p per il miglior equilibrio, 1080p per più dettaglio o 4K per la massima nitidezza.
6) Genera audio — Lascialo attivo per dialoghi, SFX o musica; disattivalo per un video muto.
7) Seed opzionale — Mantieni fisso il seed per attribuire le variazioni al prompt o ai media, non alla casualità.
8) Ricerca web opzionale — Aggiungi tools '[{ "type": "web_search" }]' per consentire ricerche aggiornate; al termine leggi 'usage.tool_usage.web_search' nella query dell’attività.
9) Genera e perfeziona — Modifica le parole, sostituisci i riferimenti o regola proporzioni, durata e risoluzione.
In breve, Seedance 2.0 Pro su RunComfy supporta testo, fino a nove immagini, tre video e tre audio di riferimento, clip da 4–15 s, preset 480p–4K, proporzioni flessibili incluso adaptive e audio nativo opzionale, in linea con i campi del playground.
Trasforma un'immagine di riferimento in un video di 5 o 10 secondi, con prompt negativo opzionale e generazione di audio nativo.
Genera video cinematografici text-to-video nativi in 4K con dialoghi sincronizzati e personaggi coerenti.
Anima un’immagine di riferimento usando il movimento di un video guida.
Genera un video da un prompt testuale obbligatorio con controlli precisi per proporzioni, risoluzione, durata, stile, seed, audio, più clip e ottimizzazione.
Crea brani da prompt con output WAV a 44.1 kHz e modifica delle singole sezioni.
Estendi un video esistente di 7 secondi a 720p, con guida tramite prompt e generazione audio opzionale.
In questo playground la risoluzione può essere 480p, 720p (predefinita), 1080p o 4K. Le proporzioni possono essere adaptive (predefinito: il modello sceglie il rapporto più vicino e il risultato dell’attività riporta quello effettivo) oppure fisse: 16:9, 9:16, 4:3, 3:4, 1:1 o 21:9.
Per il prompt sono consigliati circa ≤500 caratteri in cinese o ≤1000 parole in inglese. Puoi usare fino a 9 immagini (jpeg, png, webp, bmp, tiff, gif), 3 video (mp4, mov) da 2–15 secondi ciascuno e 3 file audio (wav, mp3), ciascuno da 2–15 secondi e meno di 15 MB. Solo il prompt è obbligatorio.
Usa l’API RunComfy con gli stessi campi Input del playground: prompt, image_url, video_url, audio_url, aspect_ratio, duration, resolution, generate_audio e seed. Verifica prompt e limiti dei media nell’interfaccia, quindi usa chiave API e crediti del tuo account per automatizzare i processi.
Punta a brevi clip cinematografiche con riferimenti multimodali, controllo della durata da 4–15 secondi, proporzioni flessibili incluso adaptive e audio nativo quando generate_audio è attivo, utile per lip-sync, SFX e musica sincronizzati. I benchmark dipendono dai contenuti: confronta risultati con gli stessi prompt e riferimenti.
La scelta dipende dal flusso di lavoro. Questo template offre fino a nove immagini, tre video, tre audio, preset 480p–4K e audio generato attivabile. Wan 2.5 e Kling 2.6 hanno prezzi, limiti e punti di forza diversi: provali in parallelo sui tuoi prompt e riferimenti tipici.
Sì. Immagini di riferimento, eventuali video o audio e un prompt chiaro aiutano a vincolare identità, abbigliamento e tono. Lo schema API non documenta una sintassi speciale “@”: la coerenza nasce dall’allineamento tra testo e media nei limiti supportati.
Quando Generate audio (generate_audio) è true, per impostazione predefinita il modello produce video con audio sincronizzato — voce, SFX e musica. Impostalo su false per un video muto. La qualità del lip-sync dipende comunque dalla chiarezza del prompt e dalla scena.
Duration è un numero intero da 4 a 15 secondi, con 5 predefinito. Puoi scegliere qualsiasi valore intero nell’intervallo per ogni generazione.
L’uso commerciale dipende dalla licenza del modello di ByteDance e dai termini di servizio RunComfy. Consulta licenza e documentazione ufficiali o contatta hi@runcomfy.com prima di usare i video in campagne a pagamento o distribuzioni pubbliche.
Team e creator che vogliono brevi clip cinematografiche con riferimenti opzionali a immagini, video e audio, proporzioni per diverse piattaforme, esportazione fino a 4K e audio integrato: annunci, social video, previsualizzazione e test narrativi di brand.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





