Crea un video con Sora 2 Pro a partire da un prompt e scegli dimensioni e durata.
Questo modello prende un’immagine e un’istruzione scritta, quindi anima l'immagine in una breve clip cinematografica con audio integrato. Si trova all'interno della famiglia Gemini Omni Flash di Google, che comprende anche testo-video, editing video e riferimento-video; questa pagina RunComfy esegue l'attività da immagine a video.
Poiché il modello ragiona su come si comporta il mondo fisico, il movimento rimane coerente dal primo fotogramma in poi invece di andare alla deriva o deformarsi man mano che l'inquadratura si svolge.
Gli input corrispondono allo schema RunComfy OpenAPI Input per l'attività da immagine a video.
| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo / Opzioni | Descrizione |
|---|---|---|---|---|---|
| prompt* | Sì (*) | string | — | testo descrittivo | Descrive come deve muoversi o cambiare l’immagine di input |
| image_url* | Sì (*) | string (URI immagine) | — | jpg, jpeg, png, webp | L’immagine fissa da animare |
| aspect_ratio | No | string | 16:9 | 16:9, 9:16 | Proporzioni del video generato |
| duration | No | integer | 8 | 3–10 (secondi) | Durata del video generato in secondi interi |
La fatturazione si basa sulla lunghezza del clip generato:
Crea un video con Sora 2 Pro a partire da un prompt e scegli dimensioni e durata.
Video realistici da testo o immagine con controllo creativo totale.
Testo in video cinematografico premium con la massima fedeltà visiva nella famiglia Kling V3.0.
Genera un video con audio sincronizzato da un prompt di testo obbligatorio. Scegli `1280x720` o `720x1280` e una durata di `4`, `8` o `12` secondi.
Trasforma un ritratto e un video di riferimento in un'animazione espressiva guidata da un prompt di testo richiesto.
Crea film multi-scena con dialoghi sincronizzati e personaggi coerenti. Use Kling 3.0 on RunComfy.
Gemini Omni Flash Image to Video acquisisce una singola immagine fissa e un prompt testuale, quindi anima l'immagine in una breve clip con audio sincronizzato. Deduce il movimento naturale del soggetto e della scena, quindi puoi trasformare un fotogramma in uno scatto in movimento con supporto audio senza un'animazione separata o un passaggio audio.
Funziona bene per trasformare foto fisse in brevi clip sociali, testare i movimenti della fotocamera e il ritmo da un'immagine di riferimento e prototipare rapidamente concetti audiovisivi. Creatori, esperti di marketing e team cinematografici o di giochi utilizzano spesso Gemini Omni Flash Image to Video per esplorare il movimento e l'atmosfera prima di impegnarsi in un passaggio di produzione completo.
Il modello genera il suono in linea con l'immagine animata, inclusi parlato, effetti ambientali e musica, ove appropriato. Puoi guidarlo nel prompt con Gemini Omni Flash Image to Video nominando il tono del dialogo o il suono di sottofondo che desideri o chiedendo “nessun dialogo” quando hai bisogno di una clip silenziosa.
Iniziare da un'immagine caricata ti offre un controllo più stretto sulla composizione di apertura e sull'identità del soggetto rispetto a un prompt basato solo sul testo. Con Gemini Omni Flash Image to Video, l'immagine fissa l’aspetto mentre il prompt dirige il modo in cui si muove la scena, il che è utile quando hai già in mente un fotogramma specifico.
Gemini Omni Flash Image to Video supporta l'inquadratura orizzontale 16:9 e l'inquadratura verticale 9:16, con lunghezze di clip da 3 a 10 secondi interi. Controlla il pannello dei parametri RunComfy corrente per le opzioni esatte, poiché le impostazioni disponibili possono cambiare nel tempo.
Fornisci un'immagine di input più un prompt testuale che descrive il movimento; i formati immagine supportati includono jpg, jpeg, png e webp. Per eventuali limiti non elencati nel pannello, rivedere i campi dei parametri RunComfy, poiché alcuni vincoli possono variare in base alle impostazioni del provider.
SÌ. Puoi prototipare Gemini Omni Flash Image to Video nell'interfaccia utente del modello AI RunComfy, quindi chiamare lo stesso modello tramite RunComfy HTTP API con parametri identici per l'automazione e la produzione. Ciò ti consente di passare dal test all'integrazione senza ospitare o ridimensionare il modello da solo.
L’utilizzo di Gemini Omni Flash Image to Video viene addebitato in base alla durata del video generato, al costo di $0.14 al secondo. L’importo viene scalato dal saldo in USD o dai crediti dell’account RunComfy. I nuovi utenti di solito ricevono un credito di prova; consulta il prezzo aggiornato nella sezione di generazione di questa pagina.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





