FLUX 3 Video transforma prompts de texto em clipes cinematográficos com áudio nativo
Este modelo recebe uma imagem e uma instrução escrita e transforma a imagem em um pequeno clipe cinematográfico com som integrado. Ele faz parte da família Gemini Omni Flash do Google, que também abrange texto para vídeo, edição de vídeo e referência para vídeo; esta página RunComfy executa a tarefa de imagem para vídeo.
Como o modelo raciocina sobre como o mundo físico se comporta, o movimento permanece coerente a partir do primeiro quadro, em vez de se desviar ou deformar à medida que a cena se desenrola.
As entradas correspondem ao esquema RunComfy OpenAPI Input para a tarefa de imagem para vídeo.
| Parâmetro | Obrigatório | Tipo | Padrão | Intervalo / Opções | Descrição |
|---|---|---|---|---|---|
| prompt* | Sim (*) | string | — | texto descritivo | Descreve como a imagem de entrada deve se mover ou mudar |
| image_url* | Sim (*) | string (URI de imagem) | — | jpg, jpeg, png, webp | A imagem estática a ser animada |
| aspect_ratio | Não | string | 16:9 | 16:9, 9:16 | Proporção do vídeo gerado |
| duration | Não | integer | 8 | 3–10 (segundos) | Duração do vídeo gerado em segundos inteiros |
A cobrança é baseada na duração do clipe gerado:
FLUX 3 Video transforma prompts de texto em clipes cinematográficos com áudio nativo
Anime uma foto estática em um vídeo fluido de 720P ou 1080P a partir de um único prompt.
Texto para vídeo cinematográfico premium com a mais alta fidelidade visual da família Kling V3.0.
Gere voz a partir de texto e sincronize-a com um vídeo; escolha voz, idioma e velocidade.
Estenda um vídeo existente em 7 segundos a 720p, com orientação por prompt e geração opcional de áudio.
Reestilize um vídeo existente com instruções de texto, preservando o movimento original e a composição geral.
Gemini Omni Flash Image to Video captura uma única imagem estática e um prompt de texto e, em seguida, anima a imagem em um clipe curto com áudio sincronizado. Ele infere movimento natural para o assunto e a cena, para que você possa transformar um quadro em uma cena em movimento e com som, sem uma animação ou etapa de áudio separada.
Ele funciona bem para transformar fotos estáticas em clipes sociais curtos, testar movimentos e ritmo da câmera a partir de uma imagem de referência e criar protótipos de conceitos audiovisuais rapidamente. Criadores, profissionais de marketing e equipes de filmes ou jogos costumam usar Gemini Omni Flash Image to Video para explorar o movimento e a atmosfera antes de se comprometerem com uma passagem completa de produção.
O modelo gera som em sintonia com a imagem animada, incluindo fala, efeitos ambientais e música quando apropriado. Você pode orientar isso no prompt com Gemini Omni Flash Image to Video nomeando o tom de diálogo ou som de fundo desejado ou pedindo que não haja diálogo quando precisar de um clipe silencioso.
Começar a partir de uma imagem carregada oferece um controle mais rígido sobre a composição de abertura e a identidade do assunto do que um prompt somente de texto. Com Gemini Omni Flash Image to Video, o still ancora o visual enquanto o prompt direciona o movimento da cena, o que é útil quando você já tem um quadro específico em mente.
Gemini Omni Flash Image to Video suporta enquadramento de paisagem 16:9 e retrato 9:16, com durações de clipe de 3 a 10 segundos inteiros. Verifique o painel de parâmetros RunComfy atual para as opções exatas, pois as configurações disponíveis podem mudar com o tempo.
Você fornece uma imagem de entrada mais um prompt de texto descrevendo o movimento; os formatos de imagem suportados incluem jpg, jpeg, png e webp. Para quaisquer limites não listados no painel, revise os campos de parâmetros RunComfy, pois algumas restrições podem variar de acordo com as configurações do provedor.
Sim. Você pode prototipar Gemini Omni Flash Image to Video na IU do modelo RunComfy AI e, em seguida, chamar o mesmo modelo por meio de RunComfy HTTP API com parâmetros idênticos para automação e produção. Isso permite que você passe do teste à integração sem hospedar ou dimensionar o modelo por conta própria.
O uso do Gemini Omni Flash Image to Video é cobrado conforme a duração do vídeo gerado, a $0.14 por segundo. O valor é descontado do saldo em USD ou dos créditos da sua conta RunComfy. Novos usuários normalmente recebem créditos de teste; consulte o preço atual na seção de geração desta página.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.





