Gere um vídeo 16:9 a partir de uma imagem e um prompt, com duração, resolução, taxa de quadros e áudio opcionais.
Este modelo lê uma ou mais imagens de referência junto com um prompt escrito e, em seguida, gera um pequeno clipe cinematográfico que mantém o assunto, a aparência e a composição referenciados enquanto adiciona movimento e som. Pertence à família Gemini Omni Flash do Google, que também abrange texto para vídeo e imagem para vídeo; esta página do RunComfy executa a tarefa de geração de vídeo a partir de imagens de referência.
Como as imagens ancoram a identidade e a direção visual, o mesmo personagem ou produto pode permanecer reconhecível do primeiro ao último quadro, em vez de variar entre as cenas.
As entradas correspondem ao esquema RunComfy OpenAPI Input para a tarefa de geração de vídeo a partir de referências.
| Parâmetro | Obrigatório | Tipo | Padrão | Intervalo / Opções | Descrição |
|---|---|---|---|---|---|
| prompt* | Sim (*) | string | — | texto descritivo | Orienta movimento, ritmo, desenvolvimento da cena e áudio |
| image_urls* | Sim (*) | array (URIs de imagem) | — | jpg, jpeg, png, webp | Uma ou mais imagens de referência para orientar assunto, estilo e composição |
| aspect_ratio | Não | string | 16:9 | 16:9, 9:16 | Proporção do vídeo gerado |
| duration | Não | integer | 8 | 3–10 (segundos) | Duração do vídeo gerado em segundos inteiros |
A cobrança é baseada na duração do clipe gerado:
Gere um vídeo 16:9 a partir de uma imagem e um prompt, com duração, resolução, taxa de quadros e áudio opcionais.
Crie filmes multicenas com diálogos sincronizados e personagens consistentes. Use Kling 3.0 on RunComfy.
HappyHorse 1.0 Video Edit no Alibaba edita um vídeo de entrada com instruções de texto e imagens de referência para transferência de estilo, substituição local e troca de roupas.
Vídeos realistas com controle criativo total em estrutura e estilo.
Seedance 2.5: Animar uma imagem estática em vídeo cinematográfico de IA
Transformação de vídeos por IA com movimento estável e controle criativo.
Gemini Omni Flash Reference to Video pega uma ou mais imagens de referência e um prompt de texto e gera um clipe curto com áudio sincronizado. As imagens de referência orientam o assunto, o estilo e o layout, enquanto o prompt direciona o movimento, o ritmo, o desenvolvimento da cena e o som, para que suas imagens definam a aparência e o texto dê vida a ela.
Ele funciona bem para manter a aparência de um personagem, produto ou marca consistente em um clipe curto, criar tomadas cinematográficas guiadas por referências e produzir promoções a partir de recursos visuais existentes. Profissionais de marketing, cineastas, equipes de jogos e criadores sociais costumam usar Gemini Omni Flash Reference to Video quando a identidade e a direção visual precisam ficar próximas de suas imagens de origem.
Você pode fornecer uma ou mais imagens de referência e os formatos suportados incluem jpg, jpeg, png e webp. Com Gemini Omni Flash Reference to Video você pode mencionar a contribuição de cada imagem no prompt, como personagem, roupa ou ambiente, para orientar como ela molda o resultado. Verifique o painel de parâmetros RunComfy atual para os limites de entrada exatos.
O modelo gera som em sintonia com o vídeo, incluindo fala, efeitos ambientais e música quando apropriado. Você pode orientar isso no prompt com Gemini Omni Flash Reference to Video nomeando o tom de diálogo ou som de fundo desejado ou pedindo que não haja diálogo quando precisar de um clipe silencioso.
O fornecimento de imagens de referência oferece um controle mais rígido sobre a identidade, o estilo e o layout do assunto do que um prompt somente de texto. Com Gemini Omni Flash Reference to Video, as imagens ancoram a aparência da cena enquanto o prompt direciona como ela se move, o que ajuda quando você já tem personagens ou cenas específicas que deseja transportar para o clipe.
Gemini Omni Flash Reference to Video suporta enquadramento de paisagem 16:9 e retrato 9:16, com durações de clipe de 3 a 10 segundos inteiros. Verifique o painel de parâmetros RunComfy atual para as opções exatas, pois as configurações disponíveis podem mudar com o tempo.
Sim. Você pode prototipar Gemini Omni Flash Reference to Video na IU do modelo RunComfy AI e, em seguida, chamar o mesmo modelo por meio de RunComfy HTTP API com parâmetros idênticos para automação e produção. Isso permite que você passe do teste à integração sem hospedar ou dimensionar o modelo por conta própria.
O uso do Gemini Omni Flash Reference to Video é cobrado conforme a duração do vídeo gerado, a $0.14 por segundo. O valor é descontado do saldo em USD ou dos créditos da sua conta RunComfy. Novos usuários normalmente recebem créditos de teste; consulte o preço atual na seção de geração desta página.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.





