Anima l'immagine di un personaggio di riferimento con il movimento di un video di movimento utilizzando i controlli di suggerimento, risoluzione, inferenza, guida dell'immagine e guida della posa.
Questo modello legge una o più immagini di riferimento insieme a un suggerimento scritto, quindi genera una breve clip cinematografica che mantiene il soggetto, l'aspetto e la composizione di riferimento aggiungendo movimento e suono. Appartiene alla famiglia Gemini Omni Flash di Google, che copre anche la conversione da testo a video e da immagine a video; questa pagina RunComfy esegue l'attività di video da immagini di riferimento.
Poiché le immagini ancorano l'identità e la direzione visiva, lo stesso personaggio o prodotto può rimanere riconoscibile dal primo fotogramma all'ultimo invece di spostarsi da uno scatto all'altro.
Gli input corrispondono allo schema RunComfy OpenAPI Input per l'attività di video da immagini di riferimento.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| prompt* | Sì (*) | string | — | testo descrittivo | Dirige movimento, ritmo, sviluppo della scena e audio |
| image_urls* | Sì (*) | array (URI immagini) | — | jpg, jpeg, png, webp | Una o più immagini di riferimento per soggetto, stile e composizione |
| aspect_ratio | No | string | 16:9 | 16:9, 9:16 | Proporzioni del video generato |
| duration | No | integer | 8 | 3–10 (secondi) | Durata del video generato in secondi interi |
La fatturazione si basa sulla lunghezza del clip generato:
Anima l'immagine di un personaggio di riferimento con il movimento di un video di movimento utilizzando i controlli di suggerimento, risoluzione, inferenza, guida dell'immagine e guida della posa.
FLUX 3 Draft Keyframe: anteprime video veloci con più fotogrammi chiave a 720p
Genera un video di 5 o 10 secondi tra un’immagine iniziale e una finale, entrambe obbligatorie. Descrivi la transizione nel prompt con @Image1 e @Image2.
Modifica con precisione un segmento di una traccia audio lasciando invariato il resto.
Video realistici, movimento fluido e controllo creativo avanzato
Crea un’immagine da un prompt e controlla LoRA, dimensioni, formato, passaggi, prompt negativo e seed.
Gemini Omni Flash Reference to Video prende una o più immagini di riferimento e un prompt testuale, quindi genera una breve clip con audio sincronizzato. Le immagini di riferimento guidano il soggetto, lo stile e il layout, mentre il prompt dirige il movimento, il ritmo, lo sviluppo della scena e il suono, in modo che le tue immagini definiscano l'aspetto e il testo gli dia vita.
Funziona bene per mantenere coerente l'aspetto di un personaggio, di un prodotto o di un marchio in una breve clip, costruendo riprese cinematografiche guidate da riferimenti e producendo promo da immagini esistenti. Gli esperti di marketing, i registi, i team di gioco e i creatori di social utilizzano spesso Gemini Omni Flash Reference to Video quando l'identità e la direzione visiva devono rimanere vicine alle immagini originali.
Puoi fornire una o più immagini di riferimento e i formati supportati includono jpg, jpeg, png e webp. Con Gemini Omni Flash Reference to Video puoi menzionare il contributo di ciascuna immagine nel prompt, come il personaggio, l'abito o l'ambiente, per orientare il modo in cui modella il risultato. Controllare il pannello dei parametri RunComfy corrente per gli esatti limiti di ingresso.
Il modello genera l'audio in sintonia con il video, inclusi parlato, effetti ambientali e musica, ove appropriato. Puoi guidarlo nel prompt con Gemini Omni Flash Reference to Video nominando il tono del dialogo o il suono di sottofondo che desideri o chiedendo “nessun dialogo” quando hai bisogno di una clip silenziosa.
Fornire immagini di riferimento offre un controllo più stretto sull'identità, lo stile e il layout del soggetto rispetto a un prompt basato solo sul testo. Con Gemini Omni Flash Reference to Video, le immagini ancorano l'aspetto della ripresa mentre il prompt dirige come si muove, il che aiuta quando hai già personaggi o scene specifici che desideri inserire nella clip.
Gemini Omni Flash Reference to Video supporta l'inquadratura orizzontale 16:9 e l'inquadratura verticale 9:16, con lunghezze di clip da 3 a 10 secondi interi. Controlla il pannello dei parametri RunComfy corrente per le opzioni esatte, poiché le impostazioni disponibili possono cambiare nel tempo.
SÌ. Puoi prototipare Gemini Omni Flash Reference to Video nell'interfaccia utente del modello AI RunComfy, quindi chiamare lo stesso modello tramite RunComfy HTTP API con parametri identici per l'automazione e la produzione. Ciò ti consente di passare dal test all'integrazione senza ospitare o ridimensionare il modello da solo.
L’utilizzo di Gemini Omni Flash Reference to Video viene addebitato in base alla durata del video generato, al costo di $0.14 al secondo. L’importo viene scalato dal saldo in USD o dai crediti dell’account RunComfy. I nuovi utenti di solito ricevono un credito di prova; consulta il prezzo aggiornato nella sezione di generazione di questa pagina.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





