logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Gemini Omni Flash: texto para vídeo com áudio sincronizado | RunComfy

google/gemini-omni-flash/text-to-video

Gemini Omni Flash gera a partir de um prompt vídeos cinematográficos curtos com áudio nativo sincronizado, nos formatos 16:9 ou 9:16 e com duração de 3 a 10 segundos.

Descreva o vídeo que deseja gerar. É possível controlar ritmo e áudio no próprio prompt, por exemplo “em uma única tomada contínua”, “música de fundo calma” ou “sem diálogo”, e incluir instruções negativas como “não mostrar texto”.
Proporção do vídeo gerado.
Duração do vídeo gerado, em segundos.
Idle
The rate is $0.13 per second of generated video.

Introdução ao Gemini Omni Flash

O Gemini Omni Flash do Google transforma um único prompt em um clipe cinematográfico de 3 a 10 segundos com áudio sincronizado. O conhecimento de mundo real do Gemini ajuda a produzir movimentos coerentes e fisicamente plausíveis. Em vez de editar vídeo, criar o som e conectar várias ferramentas separadamente, equipes de marketing, cineastas, estúdios de jogos e criadores sociais podem dirigir todo o resultado em um só prompt. O Gemini Omni Flash pode ser usado no RunComfy pelo navegador ou pela API HTTP, sem hospedar nem escalar o modelo.
Ideal para: Anúncios sociais curtos | Momentos narrativos cinematográficos | Pré-visualização rápida

Google / Gemini Omni Flash#


Gemini Omni Flash é a família de geração de vídeo multimodal do Google, construída com base no conhecimento do mundo real do Gemini e em uma compreensão mais forte da física para movimentos e interações mais confiáveis. A família mais ampla abrange quatro tarefas relacionadas: texto para vídeo, imagem para vídeo, edição de vídeo e referência para vídeo. Esta página RunComfy executa a tarefa de texto para vídeo, transformando um prompt escrito em um pequeno clipe cinematográfico com áudio sincronizado.


Como raciocina sobre como o mundo realmente se comporta, o modelo mantém os objetos, a iluminação e o movimento coerentes ao longo de uma cena, em vez de oscilar quadro a quadro.


Destaques#


  • Áudio sincronizado nativo: Gere fala, efeitos sonoros e música alinhados à ação, para que um clipe esteja pronto para ser compartilhado sem uma passagem de áudio separada.
  • Movimento com reconhecimento de física: A compreensão física aprimorada produz movimentos e interações com objetos mais constantes e naturais.
  • Baseado em conhecimento real: Os resultados baseiam-se no conhecimento do mundo real do Gemini, ajudando as cenas a parecerem plausíveis e pertinentes ao assunto.
  • Controle no nível do prompt: Ritmo direto e som direto do prompt (por exemplo, uma única tomada contínua, música de fundo calma ou nenhum diálogo).
  • Família de quatro tarefas: A linha Gemini Omni Flash abrange texto para vídeo, imagem para vídeo, edição de vídeo e referência para vídeo; esta página expõe apenas a tarefa de texto para vídeo.
  • Enquadramento flexível: Suporta paisagem 16:9 e retrato 9:16, com durações de 3 a 10 segundos.

Parâmetros#


As entradas correspondem ao esquema RunComfy OpenAPI Input para a tarefa de texto para vídeo.


ParâmetroObrigatórioTipoPadrãoIntervalo / OpçõesDescrição
prompt*Sim (*)string—Texto descritivoPrompt do vídeo a ser gerado
aspect_ratioNãostring16:916:9, 9:16Proporção do vídeo
durationNãointeger83–10 (segundos)Duração do vídeo em segundos inteiros

Preços#


A cobrança é baseada na duração do clipe gerado:


  • Vídeo: US$ 0,13 por segundo de vídeo gerado.

Como usar#


  1. Escreva um prompt descritivo — Descreva o assunto, a ação, o cenário, o clima, a iluminação e a câmera. Os prompts detalhados fornecem ao modelo mais trabalho.
  2. Defina o ritmo em palavras — Peça uma única sequência contínua ou um ritmo específico diretamente no prompt.
  3. Direcione o áudio — Solicite diálogo, som ambiente ou música de fundo, ou não diga nenhum diálogo quando quiser que fique silencioso.
  4. Adicionar instruções negativas — Coloque exclusões no próprio prompt, como não mostrar texto.
  5. Escolha uma proporção — Escolha 16:9 para paisagem ou 9:16 para entrega vertical, priorizando dispositivos móveis.
  6. Defina a duração — Escolha qualquer número inteiro de segundos de 3 a 10.
  7. Gerar e refinar — Revise o clipe, ajuste o texto, a proporção ou a duração e execute novamente.

Dicas de prompt e referência#


  • Conduza com a câmera e o movimento desejado (por exemplo, push-in lento, portátil ou bloqueado).
  • Dê um nome ao clima e à iluminação para que a cena fique como você pretende.
  • Mantenha uma ação clara por clipe; prompts focados em recompensas de curta duração.
  • Explique a paisagem sonora quando o áudio for importante, pois o modelo pode gerar áudio sincronizado.
  • Use frases negativas simples (por exemplo, nenhum texto na tela) em vez de dicas vagas.
  • Se um resultado parecer complicado, simplifique a solicitação e remova dicas de estilo concorrentes.

Como o Gemini Omni Flash se compara a outros modelos#


  • Versus modelos anteriores de texto para vídeo: Ele enfatiza o movimento com reconhecimento de física e o áudio sincronizado nativo em uma única etapa. Com base nas informações disponíveis publicamente, compare com suas próprias instruções.
  • Versus geradores de vídeo silenciosos: Ele agrupa a geração de áudio, para que você pule uma etapa separada de pontuação ou design de som.
  • Dentro de sua própria família: A conversão de texto em vídeo é uma das quatro tarefas desta família; fluxos de trabalho de imagem para vídeo, edição de vídeo e referência para vídeo que começam a partir de mídia existente em vez de apenas texto.

Mais modelos para experimentar#


  • Veo 3 Fast — Texto rápido para vídeo com áudio para rascunhos rápidos.
  • Seedance 2.5 — Vídeo cinematográfico multimodal com suporte de referência.
  • Kling Video — Geração de vídeo com foco em movimento.
  • Wan 2.5 — Alternativa de texto para vídeo de uso geral.

Recursos Oficiais#


  • Google DeepMind: https://deepmind.google/

Modelos relacionados

cinematic-video-generator

Geração de vídeo com qualidade cinematográfica no nível do Seedance 2.0, alta fidelidade visual e movimento natural

runway-gen-4/turbo/image-to-video

Vídeos curtos com personagens e cenários coerentes e animados

one-to-all-animation/1.3b

Anime uma imagem de personagem de referência com movimento de um vídeo de movimento usando avisos positivos e negativos, além de configurações de geração ajustáveis.

kling-video-o1/image-to-video/reference

Gere um vídeo a partir de imagens de referência e elementos obrigatórios. Use tokens @Image e @Element na ordem dos arrays e defina com precisão a duração e a proporção.

veo-3-1/fast/text-to-video

Crie vídeos cinematográficos em segundos com Veo 3.1 Fast, gerando animações a partir de texto com total controle criativo.

happyhorse-1.1/image-to-video

Anime uma foto estática em um vídeo fluido de 720P ou 1080P a partir de um único prompt.

Perguntas Frequentes

Para que é usado o Gemini Omni Flash?

Gemini Omni Flash é o modelo de vídeo multimodal do Google que transforma um prompt de texto em um pequeno clipe cinematográfico com áudio sincronizado. Nesta página RunComfy, ele executa a tarefa de texto para vídeo, tornando-o adequado para anúncios sociais, histórias e pré-visualização rápida, onde o movimento e o som são importantes.

Quais tarefas a família Gemini Omni Flash cobre?

A família Gemini Omni Flash abrange quatro tarefas relacionadas: texto para vídeo, imagem para vídeo, edição de vídeo e referência para vídeo. Esta página RunComfy expõe a tarefa de texto para vídeo, que gera um vídeo apenas a partir de um prompt escrito, enquanto as outras tarefas começam a partir de imagens ou filmagens existentes.

O Gemini Omni Flash gera áudio com o vídeo?

Sim. Gemini Omni Flash produz áudio sincronizado – como fala, efeitos sonoros e música – alinhado à ação gerada. Você pode direcionar o som a partir do prompt, por exemplo, solicitando uma música de fundo calma ou especificando nenhum diálogo.

O que faz o movimento do Gemini Omni Flash parecer mais natural?

Gemini Omni Flash é baseado no conhecimento do mundo real do Gemini e possui uma compreensão aprimorada da física, o que o ajuda a manter o movimento, a iluminação e a interação de objetos coerentes em uma cena. Isso reduz o desvio quadro a quadro comum em modelos mais antigos de texto para vídeo.

Quais limites de entrada devo saber antes de usar o Gemini Omni Flash?

A tarefa de texto para vídeo exige um prompt obrigatório, uma proporção de 16:9 ou 9:16 e uma duração entre 3 e 10 segundos. Verifique o painel de parâmetros RunComfy atual para obter os padrões exatos e quaisquer limites do lado do provedor antes de gerar.

Como devo escrever prompts para o Gemini Omni Flash?

Seja descritivo sobre o assunto, a ação, a câmera, o clima e a iluminação e controle o ritmo diretamente no prompt (por exemplo, uma única tomada contínua). Coloque exclusões no próprio prompt, como “não mostrar texto”, pois o Gemini Omni Flash lê instruções negativas do prompt.

Os desenvolvedores podem usar o Gemini Omni Flash por meio da API RunComfy?

Sim. Você pode criar um protótipo do Gemini Omni Flash na interface do modelo RunComfy e depois chamar o mesmo modelo por meio da API RunComfy com parâmetros idênticos. Isso permite que você passe de um teste de navegador para a geração automatizada sem hospedar ou dimensionar o modelo por conta própria.

Quanto custa gerar com Gemini Omni Flash no RunComfy?

As gerações com Gemini Omni Flash são cobradas a US$ 0,13 por segundo de vídeo gerado e retiram seu USD RunComfy ou saldo de crédito. Novos usuários normalmente começam com um valor de teste gratuito; consulte a seção Geração nesta página para obter detalhes atuais.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.

Exemplos de Gemini Omni Flash

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...