Trasforma immagini statiche in clip video cinematografiche con transizioni fluide, realistiche e flessibilità creativa – powered by Seedance 1.5 Pro.
React-1 accetta un video_url e un audio_url richiesti e crea un montaggio con sincronizzazione labiale. Entrambi gli input devono durare 15 secondi o meno. Puoi guidare la performance con emotion, scegliere l'ambito di modifica con model_mode, decidere come vengono gestite le lunghezze di input non corrispondenti con lipsync_mode e regolare l'espressività con temperature.
| Parametro | Obbligatorio | Predefinito / opzioni | Cosa controlla |
|---|---|---|---|
video_url | Sì | URL video di esempio | URL pubblico per il video sorgente; 15 secondi o meno. |
audio_url | Sì | URL audio di esempio | URL pubblico per l'audio di guida; 15 secondi o meno. |
emotion | No | Predefinito neutral | Valori esatti: happy, angry, sad, neutral, disgusted, surprised. Sono supportati solo i valori emotivi di una parola. |
model_mode | No | Predefinito face | Valori esatti: lips, face, head. Imposta la regione di modifica e l'ambito del movimento. |
lipsync_mode | No | Predefinito bounce | Valori esatti: cut_off, loop, bounce, silence, remap. Controlla la gestione quando le durate audio e video differiscono. |
temperature | No | Predefinito 0.5; 0–1 | Controlla l'espressività della sincronizzazione labiale. |
emotion esatto e il model_mode più stretto adatto.lipsync_mode quando le lunghezze di input differiscono, quindi regola temperature a piccoli passi.Trasforma immagini statiche in clip video cinematografiche con transizioni fluide, realistiche e flessibilità creativa – powered by Seedance 1.5 Pro.
Crea con Wan 2.2 Plus un video di cinque secondi da un prompt e scegli dimensioni, seed ed espansione del prompt.
Crea clip a 1080p con più riferimenti e controllo dei fotogrammi.
Crea un video con Wan 2.1 da un prompt di testo e imposta risoluzione, proporzioni, numero di fotogrammi, frame rate e altre opzioni.
Genera un video di 5 o 10 secondi da un prompt richiesto. Scegli `16:9`, `9:16` o `1:1`, aggiungi un prompt negativo facoltativo e regola l'intensità del prompt.
Trasforma un ritratto e un video di riferimento in un'animazione espressiva guidata da un prompt di testo richiesto.
Questa pagina documenta React-1 come un flusso di lavoro di sincronizzazione labiale video e audio con controlli di emozione, ambito di modifica, gestione delle discrepanze ed espressività. Non include dati di benchmark rispetto a Lipsync-2 o Lipsync-2-Pro, quindi le affermazioni relative alla qualità o alla conservazione dell'identità non possono essere confermate solo dallo schema.
Sì. Fornisci la clip esistente tramite video_url obbligatorio e il percorso di guida tramite audio_url obbligatorio. Entrambi devono durare 15 secondi o meno. Quindi scegli emotion, model_mode, lipsync_mode e temperature secondo necessità.
Lo schema limita gli input video_url e audio_url a 15 secondi ciascuno. Non espone le impostazioni di risoluzione di output, proporzioni, frequenza fotogrammi, formato di output, ControlNet o adattatore IP, pertanto le dichiarazioni 4K, 1080p e 16:9 non vengono stabilite da questa pagina.
No. Gli input documentati video_url e audio_url devono durare ciascuno 15 secondi o meno. Lo schema non descrive una modalità con sequenza più lunga.
Dopo aver testato le impostazioni, utilizza l'RunComfy endpoint API e invia gli stessi campi documentati: video_url, audio_url, emotion, model_mode, lipsync_mode e temperature. Consulta la documentazione API corrente per l'autenticazione, il polling dello stato, i limiti e la fatturazione.
emotion accetta esattamente happy, angry, sad, neutral, disgusted o surprised, con neutral come predefinito. model_mode imposta l'ambito di modifica e temperature regola l'espressività tra 0 e 1. Lo schema non documenta uno specifico metodo di diffusione o di geometria facciale.
Come guida pratica, utilizzare una breve clip in cui siano visibili il viso e la bocca che parlano e fornire un audio finale pulito. Un'occlusione pesante, volti molto piccoli o movimenti contrastanti possono rendere più difficile la revisione, sebbene lo schema non pubblichi soglie di qualità formali per queste condizioni.
Questa pagina inizia da un video_url esistente e guida audio_url, quindi espone i controlli delle prestazioni della sincronizzazione labiale. Non offre campi di generazione di testo in video o di immagine in video per creare una nuova scena da zero.
L'uso commerciale dipende dai termini più recenti di sincronizzazione e RunComfy e dai diritti sul video e sull'audio sorgente. Lo schema stesso non garantisce una licenza commerciale universale; verificare la licenza attuale prima della distribuzione pubblica o a pagamento.
Significa che puoi scegliere uno dei sei valori esatti emotion e impostare il motion scope su lips, face o da head a model_mode. lipsync_mode gestisce le discrepanze di durata, mentre temperature regola l'espressività. Non si dovrebbe dedurre alcuna capacità prestazionale più ampia al di là di questi controlli documentati.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





