logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Gemini Omni Flash Image to Video: anime imagens com áudio sincronizado | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video anima uma imagem enviada e cria um clipe curto com áudio nativo sincronizado. O prompt controla o movimento; há opções de 16:9 ou 9:16 e duração de 3 a 10 segundos.

Descreva como a imagem de entrada deve se mover ou mudar. No prompt, você pode indicar movimentos de câmera, ritmo e áudio, por exemplo, “aproximação lenta da câmera”, “vento suave e canto dos pássaros” ou “sem diálogo”. Também é possível adicionar instruções negativas como “Não mostrar texto”.
A imagem de entrada a ser animada. Os formatos suportados incluem jpg, jpeg, png, webp.
A proporção do vídeo gerado.
A duração do vídeo gerado, em segundos.
Idle
The rate is $0.14 per second of generated video.

Introdução ao Gemini Omni Flash Image to Video

O Gemini Omni Flash Image to Video do Google dá vida a uma imagem estática e a transforma em um clipe de 3 a 10 segundos com movimento e áudio sincronizados. A compreensão do mundo real do Gemini ajuda a manter a animação convincente. Uma única geração guiada por prompt substitui etapas separadas de animação, keyframes e design de som, sendo útil para marketing, cinema, jogos e conteúdo social. No RunComfy, o modelo pode ser usado no navegador ou via API HTTP, sem hospedagem nem escalabilidade por conta própria.
Ideal para: clipes sociais a partir de imagens | testes de conceitos audiovisuais | cenas cinematográficas guiadas por referência

Google / Gemini Omni Flash Image to Video#


Este modelo recebe uma imagem e uma instrução escrita e transforma a imagem em um pequeno clipe cinematográfico com som integrado. Ele faz parte da família Gemini Omni Flash do Google, que também abrange texto para vídeo, edição de vídeo e referência para vídeo; esta página RunComfy executa a tarefa de imagem para vídeo.


Como o modelo raciocina sobre como o mundo físico se comporta, o movimento permanece coerente a partir do primeiro quadro, em vez de se desviar ou deformar à medida que a cena se desenrola.


Destaques#


  • Animação de imagem única: comece com uma imagem estática e deixe o modelo inferir movimento natural e com reconhecimento de física para o objeto e a cena.
  • Áudio sincronizado nativo: fala, som ambiente e música são gerados em sintonia com a imagem, portanto, um clipe está pronto para ser compartilhado sem uma etapa de áudio separada.
  • Movimento guiado por prompt: descreva os movimentos, o ritmo e o humor da câmera em linguagem simples para moldar como o quadro ganha vida.
  • Baseado em conhecimento real: Os resultados baseiam-se na compreensão do mundo real do Gemini, ajudando as cenas animadas a permanecerem verossímeis e dentro do tópico.
  • Enquadramento flexível: Escolha 16:9 paisagem ou 9:16 retrato, com duração de 3 a 10 segundos ajustável em segundos inteiros.
  • Parte de uma família: A linha Gemini Omni Flash abrange diversas tarefas de vídeo; esta página se concentra em transformar imagens em movimento.

Parâmetros#


As entradas correspondem ao esquema RunComfy OpenAPI Input para a tarefa de imagem para vídeo.


ParâmetroObrigatórioTipoPadrãoIntervalo / OpçõesDescrição
prompt*Sim (*)string—texto descritivoDescreve como a imagem de entrada deve se mover ou mudar
image_url*Sim (*)string (URI de imagem)—jpg, jpeg, png, webpA imagem estática a ser animada
aspect_ratioNãostring16:916:9, 9:16Proporção do vídeo gerado
durationNãointeger83–10 (segundos)Duração do vídeo gerado em segundos inteiros

Preços#


A cobrança é baseada na duração do clipe gerado:


  • Vídeo: $0.14 por segundo de vídeo gerado.

Modelos relacionados

flux-3/text-to-video

FLUX 3 Video transforma prompts de texto em clipes cinematográficos com áudio nativo

happyhorse-1.1/image-to-video

Anime uma foto estática em um vídeo fluido de 720P ou 1080P a partir de um único prompt.

kling-3.0/pro/text-to-video

Texto para vídeo cinematográfico premium com a mais alta fidelidade visual da família Kling V3.0.

kling/lipsync/text-to-video

Gere voz a partir de texto e sincronize-a com um vídeo; escolha voz, idioma e velocidade.

veo-3-1/fast/extend-video

Estenda um vídeo existente em 7 segundos a 720p, com orientação por prompt e geração opcional de áudio.

lucy-edit/restyle

Reestilize um vídeo existente com instruções de texto, preservando o movimento original e a composição geral.

Perguntas Frequentes

O que Gemini Omni Flash Image to Video faz?

Gemini Omni Flash Image to Video captura uma única imagem estática e um prompt de texto e, em seguida, anima a imagem em um clipe curto com áudio sincronizado. Ele infere movimento natural para o assunto e a cena, para que você possa transformar um quadro em uma cena em movimento e com som, sem uma animação ou etapa de áudio separada.

Quais são os melhores casos de uso para Gemini Omni Flash Image to Video?

Ele funciona bem para transformar fotos estáticas em clipes sociais curtos, testar movimentos e ritmo da câmera a partir de uma imagem de referência e criar protótipos de conceitos audiovisuais rapidamente. Criadores, profissionais de marketing e equipes de filmes ou jogos costumam usar Gemini Omni Flash Image to Video para explorar o movimento e a atmosfera antes de se comprometerem com uma passagem completa de produção.

Como o Gemini Omni Flash Image to Video lida com o áudio?

O modelo gera som em sintonia com a imagem animada, incluindo fala, efeitos ambientais e música quando apropriado. Você pode orientar isso no prompt com Gemini Omni Flash Image to Video nomeando o tom de diálogo ou som de fundo desejado ou pedindo que não haja diálogo quando precisar de um clipe silencioso.

Qual a diferença entre Gemini Omni Flash Image to Video e geração de texto para vídeo?

Começar a partir de uma imagem carregada oferece um controle mais rígido sobre a composição de abertura e a identidade do assunto do que um prompt somente de texto. Com Gemini Omni Flash Image to Video, o still ancora o visual enquanto o prompt direciona o movimento da cena, o que é útil quando você já tem um quadro específico em mente.

Quais proporções e durações o Gemini Omni Flash Image to Video suporta?

Gemini Omni Flash Image to Video suporta enquadramento de paisagem 16:9 e retrato 9:16, com durações de clipe de 3 a 10 segundos inteiros. Verifique o painel de parâmetros RunComfy atual para as opções exatas, pois as configurações disponíveis podem mudar com o tempo.

Quais limites de entrada devo saber antes de usar Gemini Omni Flash Image to Video?

Você fornece uma imagem de entrada mais um prompt de texto descrevendo o movimento; os formatos de imagem suportados incluem jpg, jpeg, png e webp. Para quaisquer limites não listados no painel, revise os campos de parâmetros RunComfy, pois algumas restrições podem variar de acordo com as configurações do provedor.

Os desenvolvedores podem usar Gemini Omni Flash Image to Video por meio da API RunComfy?

Sim. Você pode prototipar Gemini Omni Flash Image to Video na IU do modelo RunComfy AI e, em seguida, chamar o mesmo modelo por meio de RunComfy HTTP API com parâmetros idênticos para automação e produção. Isso permite que você passe do teste à integração sem hospedar ou dimensionar o modelo por conta própria.

Quanto custa gerar com Gemini Omni Flash Image to Video em RunComfy?

O uso do Gemini Omni Flash Image to Video é cobrado conforme a duração do vídeo gerado, a $0.14 por segundo. O valor é descontado do saldo em USD ou dos créditos da sua conta RunComfy. Novos usuários normalmente recebem créditos de teste; consulte o preço atual na seção de geração desta página.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.

Exemplos de Gemini Omni Flash Image to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...