logo
RunComfy
  • ComfyUI
  • TrainerNuovo
  • Modelli
  • API
  • Prezzi
discord logo
MODELLI
Esplora
Tutti i modelli
LIBRERIA
Generazioni
API DEI MODELLI
Documentazione API
Chiavi API
ACCOUNT
Utilizzo

Gemini Omni Flash Image to Video: anima immagini fisse con audio sincronizzato | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video anima un’immagine caricata in una breve clip con audio nativo sincronizzato. Il prompt controlla il movimento; sono disponibili 16:9 o 9:16 e durate da 3 a 10 secondi.

Descrivi come deve muoversi o cambiare l’immagine di input. Nel prompt puoi indicare movimenti di camera, ritmo e audio, ad esempio «lento avvicinamento della camera», «vento leggero e canto degli uccelli» o «nessun dialogo». Puoi anche aggiungere istruzioni negative come «Non mostrare testo».
L'immagine di input da animare. I formati supportati includono jpg, jpeg, png, webp.
Le proporzioni del video generato.
La durata del video generato, in secondi.
Idle
The rate is $0.14 per second of generated video.

Introduzione a Gemini Omni Flash Image to Video

Gemini Omni Flash Image to Video di Google dà vita a una singola immagine statica e la estende in una clip di 3–10 secondi con movimento e audio sincronizzati. La comprensione del mondo reale di Gemini contribuisce a rendere l’animazione credibile. Un’unica generazione guidata dal prompt sostituisce i passaggi separati di animazione, keyframe e sound design, risultando utile per marketing, cinema, videogiochi e contenuti social. Su RunComfy il modello è disponibile nel browser e tramite API HTTP, senza doverlo ospitare o scalare.
Ideale per: clip social da immagini statiche | test di concept audiovisivi | riprese cinematografiche guidate da riferimenti

Google / Gemini Omni Flash Image to Video#


Questo modello prende un’immagine e un’istruzione scritta, quindi anima l'immagine in una breve clip cinematografica con audio integrato. Si trova all'interno della famiglia Gemini Omni Flash di Google, che comprende anche testo-video, editing video e riferimento-video; questa pagina RunComfy esegue l'attività da immagine a video.


Poiché il modello ragiona su come si comporta il mondo fisico, il movimento rimane coerente dal primo fotogramma in poi invece di andare alla deriva o deformarsi man mano che l'inquadratura si svolge.


In evidenza#


  • Animazione a immagine singola: inizia da un'immagine fissa e lascia che il modello deduca il movimento naturale e fisicamente plausibile per il soggetto e la scena.
  • Audio sincronizzato nativo: Il parlato, il suono ambientale e la musica vengono generati al passo con l'immagine, quindi una clip è pronta per essere condivisa senza un passaggio audio separato.
  • Movimento diretto: descrivi i movimenti, il ritmo e l'atmosfera della telecamera in un linguaggio semplice per dare forma al modo in cui l'inquadratura prende vita.
  • Basato su conoscenze reali: i risultati si basano sulla comprensione del mondo reale da parte di Gemini, aiutando le scene animate a rimanere credibili e in tema.
  • Inquadratura flessibile: scegli 16:9 orizzontale o 9:16 verticale, con una durata da 3 a 10 secondi regolabile in secondi interi.
  • Parte di una famiglia: la gamma Gemini Omni Flash copre diverse attività video; questa pagina si concentra sulla trasformazione delle immagini in movimento.

Parametri#


Gli input corrispondono allo schema RunComfy OpenAPI Input per l'attività da immagine a video.


ParametroObbligatorioTipoPredefinitoIntervallo / OpzioniDescrizione
prompt*Sì (*)string—testo descrittivoDescrive come deve muoversi o cambiare l’immagine di input
image_url*Sì (*)string (URI immagine)—jpg, jpeg, png, webpL’immagine fissa da animare
aspect_ratioNostring16:916:9, 9:16Proporzioni del video generato
durationNointeger83–10 (secondi)Durata del video generato in secondi interi

Prezzi#


La fatturazione si basa sulla lunghezza del clip generato:


  • Video: $0.14 al secondo di video generato.

Modelli correlati

sora-2/pro/text-to-video

Crea un video con Sora 2 Pro a partire da un prompt e scegli dimensioni e durata.

Kling 1.5 Pro

Video realistici da testo o immagine con controllo creativo totale.

kling-3.0/pro/text-to-video

Testo in video cinematografico premium con la massima fedeltà visiva nella famiglia Kling V3.0.

sora-2/text-to-video

Genera un video con audio sincronizzato da un prompt di testo obbligatorio. Scegli `1280x720` o `720x1280` e una durata di `4`, `8` o `12` secondi.

fantasy-portrait/image-to-video

Trasforma un ritratto e un video di riferimento in un'animazione espressiva guidata da un prompt di testo richiesto.

kling-3.0/standard/text-to-video

Crea film multi-scena con dialoghi sincronizzati e personaggi coerenti. Use Kling 3.0 on RunComfy.

Domande Frequenti

Cosa fa Gemini Omni Flash Image to Video?

Gemini Omni Flash Image to Video acquisisce una singola immagine fissa e un prompt testuale, quindi anima l'immagine in una breve clip con audio sincronizzato. Deduce il movimento naturale del soggetto e della scena, quindi puoi trasformare un fotogramma in uno scatto in movimento con supporto audio senza un'animazione separata o un passaggio audio.

Quali sono i migliori casi d'uso per Gemini Omni Flash Image to Video?

Funziona bene per trasformare foto fisse in brevi clip sociali, testare i movimenti della fotocamera e il ritmo da un'immagine di riferimento e prototipare rapidamente concetti audiovisivi. Creatori, esperti di marketing e team cinematografici o di giochi utilizzano spesso Gemini Omni Flash Image to Video per esplorare il movimento e l'atmosfera prima di impegnarsi in un passaggio di produzione completo.

In che modo Gemini Omni Flash Image to Video gestisce l'audio?

Il modello genera il suono in linea con l'immagine animata, inclusi parlato, effetti ambientali e musica, ove appropriato. Puoi guidarlo nel prompt con Gemini Omni Flash Image to Video nominando il tono del dialogo o il suono di sottofondo che desideri o chiedendo “nessun dialogo” quando hai bisogno di una clip silenziosa.

In che modo Gemini Omni Flash Image to Video è diverso dalla generazione di testo in video?

Iniziare da un'immagine caricata ti offre un controllo più stretto sulla composizione di apertura e sull'identità del soggetto rispetto a un prompt basato solo sul testo. Con Gemini Omni Flash Image to Video, l'immagine fissa l’aspetto mentre il prompt dirige il modo in cui si muove la scena, il che è utile quando hai già in mente un fotogramma specifico.

Quali proporzioni e durate supporta Gemini Omni Flash Image to Video?

Gemini Omni Flash Image to Video supporta l'inquadratura orizzontale 16:9 e l'inquadratura verticale 9:16, con lunghezze di clip da 3 a 10 secondi interi. Controlla il pannello dei parametri RunComfy corrente per le opzioni esatte, poiché le impostazioni disponibili possono cambiare nel tempo.

Quali limiti di input dovrei conoscere prima di utilizzare Gemini Omni Flash Image to Video?

Fornisci un'immagine di input più un prompt testuale che descrive il movimento; i formati immagine supportati includono jpg, jpeg, png e webp. Per eventuali limiti non elencati nel pannello, rivedere i campi dei parametri RunComfy, poiché alcuni vincoli possono variare in base alle impostazioni del provider.

Gli sviluppatori possono utilizzare Gemini Omni Flash Image to Video tramite l'API RunComfy?

SÌ. Puoi prototipare Gemini Omni Flash Image to Video nell'interfaccia utente del modello AI RunComfy, quindi chiamare lo stesso modello tramite RunComfy HTTP API con parametri identici per l'automazione e la produzione. Ciò ti consente di passare dal test all'integrazione senza ospitare o ridimensionare il modello da solo.

Quanto costa generare con Gemini Omni Flash Image to Video su RunComfy?

L’utilizzo di Gemini Omni Flash Image to Video viene addebitato in base alla durata del video generato, al costo di $0.14 al secondo. L’importo viene scalato dal saldo in USD o dai crediti dell’account RunComfy. I nuovi utenti di solito ricevono un credito di prova; consulta il prezzo aggiornato nella sezione di generazione di questa pagina.

Seguici
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Supporto
  • Discord
  • Email
  • Stato del Sistema
  • affiliato
Modelli Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Visualizza tutti i modelli →
Modelli Immagine
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Visualizza tutti i modelli →
Legale
  • Termini di Servizio
  • Informativa sulla Privacy
  • Informativa sui Cookie
RunComfy
Copyright 2026 RunComfy. Tutti i Diritti Riservati.

RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.

Esempi di Gemini Omni Flash Image to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...