logo
RunComfy
  • ComfyUI
  • TrainerNuovo
  • Modelli
  • API
  • Prezzi
discord logo
MODELLI
Esplora
Tutti i modelli
LIBRERIA
Generazioni
API DEI MODELLI
Documentazione API
Chiavi API
ACCOUNT
Utilizzo

Gemini Omni Flash Reference to Video: clip guidate da riferimenti con audio sincronizzato | RunComfy

google/gemini-omni-flash/reference-to-video

Gemini Omni Flash Reference to Video trasforma una o più immagini di riferimento e un prompt in una breve clip con audio nativo sincronizzato. Mantiene soggetto e stile coerenti per 3–10 secondi in 16:9 o 9:16.

Descrivi il movimento, lo sviluppo della scena, il ritmo e l’audio desiderati. Puoi indicare movimenti di camera e suoni, ad esempio «lento avvicinamento della camera», «vento leggero e canto degli uccelli» o «nessun dialogo», e aggiungere istruzioni negative come «Non mostrare testo». Specifica nel prompt quale immagine caricata deve guidare soggetto, stile o composizione.
Image 1
Una o più immagini di riferimento che guidano il soggetto, lo stile, il layout e la direzione visiva del video. I formati supportati includono jpg, jpeg, png, webp.
Le proporzioni del video generato.
La durata del video generato, in secondi.
Idle
The rate is $0.14 per second of generated video.

Introduzione a Gemini Omni Flash Reference to Video

Gemini Omni Flash Reference to Video di Google crea una clip di 3–10 secondi a partire da una o più immagini di riferimento e da un prompt. Le immagini definiscono soggetto, stile e composizione; il testo controlla movimento, ritmo e audio sincronizzato. Un’unica generazione guidata dai riferimenti sostituisce i keyframe manuali e il lavoro audio separato, risultando utile per marketing, cinema, videogiochi e contenuti social che richiedono personaggi coerenti. Su RunComfy il modello è disponibile nel browser e tramite API HTTP, senza doverlo ospitare o scalare.
Ideale per: personaggi coerenti in brevi clip | riprese cinematografiche guidate da riferimenti | promozioni di prodotti e marchi

Google / Gemini Omni Flash Reference to Video#


Questo modello legge una o più immagini di riferimento insieme a un suggerimento scritto, quindi genera una breve clip cinematografica che mantiene il soggetto, l'aspetto e la composizione di riferimento aggiungendo movimento e suono. Appartiene alla famiglia Gemini Omni Flash di Google, che copre anche la conversione da testo a video e da immagine a video; questa pagina RunComfy esegue l'attività di video da immagini di riferimento.


Poiché le immagini ancorano l'identità e la direzione visiva, lo stesso personaggio o prodotto può rimanere riconoscibile dal primo fotogramma all'ultimo invece di spostarsi da uno scatto all'altro.


In evidenza#


  • Generazione guidata dai riferimenti: inserisci una o più immagini e il modello ne segue il soggetto, lo stile e il layout durante la realizzazione dello scatto.
  • Direzione guidata: Il testo controlla il movimento, lo sviluppo della scena, il ritmo e l'audio, quindi sei tu a decidere come prendere vita il riferimento.
  • Audio sincronizzato nativo: Il parlato, il suono ambientale e la musica vengono prodotti al passo con l'immagine, offrendo una clip pronta per la condivisione senza un passaggio audio separato.
  • Forte coerenza del soggetto: le immagini di riferimento aiutano a mantenere un personaggio, un oggetto o un marchio stabile in tutta la clip.
  • Inquadratura e durata flessibili: scegli 16:9 orizzontale o 9:16 verticale, con qualsiasi durata di secondo intero compresa tra 3 e 10 secondi.
  • Parte di una famiglia: la gamma Gemini Omni Flash comprende diverse attività video; questa pagina si concentra sulla generazione di video da immagini di riferimento.

Parametri#


Gli input corrispondono allo schema RunComfy OpenAPI Input per l'attività di video da immagini di riferimento.


ParametroObbligatorioTipoPredefinitoIntervallo / OpzioniDescrizione
prompt*Sì (*)string—testo descrittivoDirige movimento, ritmo, sviluppo della scena e audio
image_urls*Sì (*)array (URI immagini)—jpg, jpeg, png, webpUna o più immagini di riferimento per soggetto, stile e composizione
aspect_ratioNostring16:916:9, 9:16Proporzioni del video generato
durationNointeger83–10 (secondi)Durata del video generato in secondi interi

Prezzi#


La fatturazione si basa sulla lunghezza del clip generato:


  • Video: $0.14 al secondo di video generato.

Modelli correlati

one-to-all-animation/14b

Anima l'immagine di un personaggio di riferimento con il movimento di un video di movimento utilizzando i controlli di suggerimento, risoluzione, inferenza, guida dell'immagine e guida della posa.

flux-3/keyframes-to-video/draft

FLUX 3 Draft Keyframe: anteprime video veloci con più fotogrammi chiave a 720p

kling-video-o1/image-to-video

Genera un video di 5 o 10 secondi tra un’immagine iniziale e una finale, entrambe obbligatorie. Descrivi la transizione nel prompt con @Image1 e @Image2.

ace-step/audio-inpaint

Modifica con precisione un segmento di una traccia audio lasciando invariato il resto.

Veo 2

Video realistici, movimento fluido e controllo creativo avanzato

wan-2-2/lora/text-to-image

Crea un’immagine da un prompt e controlla LoRA, dimensioni, formato, passaggi, prompt negativo e seed.

Domande Frequenti

Cosa fa Gemini Omni Flash Reference to Video?

Gemini Omni Flash Reference to Video prende una o più immagini di riferimento e un prompt testuale, quindi genera una breve clip con audio sincronizzato. Le immagini di riferimento guidano il soggetto, lo stile e il layout, mentre il prompt dirige il movimento, il ritmo, lo sviluppo della scena e il suono, in modo che le tue immagini definiscano l'aspetto e il testo gli dia vita.

Quali sono i migliori casi d'uso per Gemini Omni Flash Reference to Video?

Funziona bene per mantenere coerente l'aspetto di un personaggio, di un prodotto o di un marchio in una breve clip, costruendo riprese cinematografiche guidate da riferimenti e producendo promo da immagini esistenti. Gli esperti di marketing, i registi, i team di gioco e i creatori di social utilizzano spesso Gemini Omni Flash Reference to Video quando l'identità e la direzione visiva devono rimanere vicine alle immagini originali.

Quante immagini di riferimento posso utilizzare con Gemini Omni Flash Reference to Video?

Puoi fornire una o più immagini di riferimento e i formati supportati includono jpg, jpeg, png e webp. Con Gemini Omni Flash Reference to Video puoi menzionare il contributo di ciascuna immagine nel prompt, come il personaggio, l'abito o l'ambiente, per orientare il modo in cui modella il risultato. Controllare il pannello dei parametri RunComfy corrente per gli esatti limiti di ingresso.

In che modo Gemini Omni Flash Reference to Video gestisce l'audio?

Il modello genera l'audio in sintonia con il video, inclusi parlato, effetti ambientali e musica, ove appropriato. Puoi guidarlo nel prompt con Gemini Omni Flash Reference to Video nominando il tono del dialogo o il suono di sottofondo che desideri o chiedendo “nessun dialogo” quando hai bisogno di una clip silenziosa.

In che modo Gemini Omni Flash Reference to Video è diverso dalla generazione di testo in video?

Fornire immagini di riferimento offre un controllo più stretto sull'identità, lo stile e il layout del soggetto rispetto a un prompt basato solo sul testo. Con Gemini Omni Flash Reference to Video, le immagini ancorano l'aspetto della ripresa mentre il prompt dirige come si muove, il che aiuta quando hai già personaggi o scene specifici che desideri inserire nella clip.

Quali proporzioni e durate supporta Gemini Omni Flash Reference to Video?

Gemini Omni Flash Reference to Video supporta l'inquadratura orizzontale 16:9 e l'inquadratura verticale 9:16, con lunghezze di clip da 3 a 10 secondi interi. Controlla il pannello dei parametri RunComfy corrente per le opzioni esatte, poiché le impostazioni disponibili possono cambiare nel tempo.

Gli sviluppatori possono utilizzare Gemini Omni Flash Reference to Video tramite l'API RunComfy?

SÌ. Puoi prototipare Gemini Omni Flash Reference to Video nell'interfaccia utente del modello AI RunComfy, quindi chiamare lo stesso modello tramite RunComfy HTTP API con parametri identici per l'automazione e la produzione. Ciò ti consente di passare dal test all'integrazione senza ospitare o ridimensionare il modello da solo.

Quanto costa generare con Gemini Omni Flash Reference to Video su RunComfy?

L’utilizzo di Gemini Omni Flash Reference to Video viene addebitato in base alla durata del video generato, al costo di $0.14 al secondo. L’importo viene scalato dal saldo in USD o dai crediti dell’account RunComfy. I nuovi utenti di solito ricevono un credito di prova; consulta il prezzo aggiornato nella sezione di generazione di questa pagina.

Seguici
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Supporto
  • Discord
  • Email
  • Stato del Sistema
  • affiliato
Modelli Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Visualizza tutti i modelli →
Modelli Immagine
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Visualizza tutti i modelli →
Legale
  • Termini di Servizio
  • Informativa sulla Privacy
  • Informativa sui Cookie
RunComfy
Copyright 2026 RunComfy. Tutti i Diritti Riservati.

RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.

Esempi di Gemini Omni Flash Reference to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...