logo
RunComfy
  • ComfyUI
  • TrainerNuovo
  • Modelli
  • API
  • Prezzi
discord logo
MODELLI
Esplora
Tutti i modelli
LIBRERIA
Generazioni
API DEI MODELLI
Documentazione API
Chiavi API
ACCOUNT
Utilizzo

Gemini Omni Flash Reference to Video: clip guidate da riferimenti con audio sincronizzato | RunComfy

google/gemini-omni-flash/reference-to-video

Gemini Omni Flash Reference to Video trasforma una o più immagini di riferimento e un prompt in una breve clip con audio nativo sincronizzato. Mantiene soggetto e stile coerenti per 3–10 secondi in 16:9 o 9:16.

Descrivi il movimento, lo sviluppo della scena, il ritmo e l’audio desiderati. Puoi indicare movimenti di camera e suoni, ad esempio «lento avvicinamento della camera», «vento leggero e canto degli uccelli» o «nessun dialogo», e aggiungere istruzioni negative come «Non mostrare testo». Specifica nel prompt quale immagine caricata deve guidare soggetto, stile o composizione.
Image 1
Una o più immagini di riferimento che guidano il soggetto, lo stile, il layout e la direzione visiva del video. I formati supportati includono jpg, jpeg, png, webp.
Le proporzioni del video generato.
La durata del video generato, in secondi.
Idle
The rate is $0.14 per second of generated video.

Introduzione a Gemini Omni Flash Reference to Video

Gemini Omni Flash Reference to Video di Google crea una clip di 3–10 secondi a partire da una o più immagini di riferimento e da un prompt. Le immagini definiscono soggetto, stile e composizione; il testo controlla movimento, ritmo e audio sincronizzato. Un’unica generazione guidata dai riferimenti sostituisce i keyframe manuali e il lavoro audio separato, risultando utile per marketing, cinema, videogiochi e contenuti social che richiedono personaggi coerenti. Su RunComfy il modello è disponibile nel browser e tramite API HTTP, senza doverlo ospitare o scalare.
Ideale per: personaggi coerenti in brevi clip | riprese cinematografiche guidate da riferimenti | promozioni di prodotti e marchi

Google / Gemini Omni Flash Reference to Video#


Questo modello legge una o più immagini di riferimento insieme a un suggerimento scritto, quindi genera una breve clip cinematografica che mantiene il soggetto, l'aspetto e la composizione di riferimento aggiungendo movimento e suono. Appartiene alla famiglia Gemini Omni Flash di Google, che copre anche la conversione da testo a video e da immagine a video; questa pagina RunComfy esegue l'attività di video da immagini di riferimento.


Poiché le immagini ancorano l'identità e la direzione visiva, lo stesso personaggio o prodotto può rimanere riconoscibile dal primo fotogramma all'ultimo invece di spostarsi da uno scatto all'altro.


In evidenza#


  • Generazione guidata dai riferimenti: inserisci una o più immagini e il modello ne segue il soggetto, lo stile e il layout durante la realizzazione dello scatto.
  • Direzione guidata: Il testo controlla il movimento, lo sviluppo della scena, il ritmo e l'audio, quindi sei tu a decidere come prendere vita il riferimento.
  • Audio sincronizzato nativo: Il parlato, il suono ambientale e la musica vengono prodotti al passo con l'immagine, offrendo una clip pronta per la condivisione senza un passaggio audio separato.
  • Forte coerenza del soggetto: le immagini di riferimento aiutano a mantenere un personaggio, un oggetto o un marchio stabile in tutta la clip.
  • Inquadratura e durata flessibili: scegli 16:9 orizzontale o 9:16 verticale, con qualsiasi durata di secondo intero compresa tra 3 e 10 secondi.
  • Parte di una famiglia: la gamma Gemini Omni Flash comprende diverse attività video; questa pagina si concentra sulla generazione di video da immagini di riferimento.

Parametri#


Gli input corrispondono allo schema RunComfy OpenAPI Input per l'attività di video da immagini di riferimento.


ParametroObbligatorioTipoPredefinitoIntervallo / OpzioniDescrizione
prompt*Sì (*)string—testo descrittivoDirige movimento, ritmo, sviluppo della scena e audio
image_urls*Sì (*)array (URI immagini)—jpg, jpeg, png, webpUna o più immagini di riferimento per soggetto, stile e composizione
aspect_ratioNostring16:916:9, 9:16Proporzioni del video generato
durationNointeger83–10 (secondi)Durata del video generato in secondi interi

Prezzi#


La fatturazione si basa sulla lunghezza del clip generato:


  • Video: $0.14 al secondo di video generato.

Modelli correlati

kling-3.0/pro/image-to-video

Image-to-video premium con la massima fedeltà visiva e il movimento più realistico della famiglia Kling V3.0.

seedance-1.0/text-to-video

Crea un video con Seedance 1.0 da un prompt e scegli risoluzione, proporzioni e durata.

wan-2-1/fusionx/image-to-video

Crea video AI cinematografici da immagini con controllo preciso

hailuo-2-3/fast/standard/image-to-video

Trasforma immagini statiche in video realistici e dinamici in pochi istanti.

seedance-2.0-mini/text-to-video

Modello video AI multi-inquadratura rapido ed economico, con audio nativo e riferimenti.

scail

Anima l'immagine di un personaggio di riferimento con il movimento di un video di guida mantenendo il personaggio riconoscibile.

Domande Frequenti

Cosa fa Gemini Omni Flash Reference to Video?

Gemini Omni Flash Reference to Video prende una o più immagini di riferimento e un prompt testuale, quindi genera una breve clip con audio sincronizzato. Le immagini di riferimento guidano il soggetto, lo stile e il layout, mentre il prompt dirige il movimento, il ritmo, lo sviluppo della scena e il suono, in modo che le tue immagini definiscano l'aspetto e il testo gli dia vita.

Quali sono i migliori casi d'uso per Gemini Omni Flash Reference to Video?

Funziona bene per mantenere coerente l'aspetto di un personaggio, di un prodotto o di un marchio in una breve clip, costruendo riprese cinematografiche guidate da riferimenti e producendo promo da immagini esistenti. Gli esperti di marketing, i registi, i team di gioco e i creatori di social utilizzano spesso Gemini Omni Flash Reference to Video quando l'identità e la direzione visiva devono rimanere vicine alle immagini originali.

Quante immagini di riferimento posso utilizzare con Gemini Omni Flash Reference to Video?

Puoi fornire una o più immagini di riferimento e i formati supportati includono jpg, jpeg, png e webp. Con Gemini Omni Flash Reference to Video puoi menzionare il contributo di ciascuna immagine nel prompt, come il personaggio, l'abito o l'ambiente, per orientare il modo in cui modella il risultato. Controllare il pannello dei parametri RunComfy corrente per gli esatti limiti di ingresso.

In che modo Gemini Omni Flash Reference to Video gestisce l'audio?

Il modello genera l'audio in sintonia con il video, inclusi parlato, effetti ambientali e musica, ove appropriato. Puoi guidarlo nel prompt con Gemini Omni Flash Reference to Video nominando il tono del dialogo o il suono di sottofondo che desideri o chiedendo “nessun dialogo” quando hai bisogno di una clip silenziosa.

In che modo Gemini Omni Flash Reference to Video è diverso dalla generazione di testo in video?

Fornire immagini di riferimento offre un controllo più stretto sull'identità, lo stile e il layout del soggetto rispetto a un prompt basato solo sul testo. Con Gemini Omni Flash Reference to Video, le immagini ancorano l'aspetto della ripresa mentre il prompt dirige come si muove, il che aiuta quando hai già personaggi o scene specifici che desideri inserire nella clip.

Quali proporzioni e durate supporta Gemini Omni Flash Reference to Video?

Gemini Omni Flash Reference to Video supporta l'inquadratura orizzontale 16:9 e l'inquadratura verticale 9:16, con lunghezze di clip da 3 a 10 secondi interi. Controlla il pannello dei parametri RunComfy corrente per le opzioni esatte, poiché le impostazioni disponibili possono cambiare nel tempo.

Gli sviluppatori possono utilizzare Gemini Omni Flash Reference to Video tramite l'API RunComfy?

SÌ. Puoi prototipare Gemini Omni Flash Reference to Video nell'interfaccia utente del modello AI RunComfy, quindi chiamare lo stesso modello tramite RunComfy HTTP API con parametri identici per l'automazione e la produzione. Ciò ti consente di passare dal test all'integrazione senza ospitare o ridimensionare il modello da solo.

Quanto costa generare con Gemini Omni Flash Reference to Video su RunComfy?

L’utilizzo di Gemini Omni Flash Reference to Video viene addebitato in base alla durata del video generato, al costo di $0.14 al secondo. L’importo viene scalato dal saldo in USD o dai crediti dell’account RunComfy. I nuovi utenti di solito ricevono un credito di prova; consulta il prezzo aggiornato nella sezione di generazione di questa pagina.

Seguici
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Supporto
  • Discord
  • Email
  • Stato del Sistema
  • affiliato
Modelli Video
  • Wan 3.0 Prime Reference To Video
  • Wan 3.0 Prime
  • Wan 3.0 Prime Text To Video
  • Wan 2.6 Flash
  • MiniMax H3 Open Image to Video
  • MiniMax H3 Open
  • Visualizza tutti i modelli →
Modelli Immagine
  • Seedream 5.0 Pro Image Edit
  • Qwen Image 3.0 Pro Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2 Image Edit
  • Visualizza tutti i modelli →
Legale
  • Termini di Servizio
  • Informativa sulla Privacy
  • Informativa sui Cookie
RunComfy
Copyright 2026 RunComfy. Tutti i Diritti Riservati.

RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.

Esempi di Gemini Omni Flash Reference to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...