Crie um vídeo de avatar a partir de um arquivo de imagem e áudio obrigatório, com um prompt de texto opcional para orientação de geração.
Seedance 2.5 Reference to Video é a abordagem de próxima geração do ByteDance Seed para transformar material de referência em um pequeno clipe cinematográfico. Ele usa imagens, vídeos e áudio de referência para impulsionar a geração enquanto se concentra em uma edição mais precisa, assuntos mais consistentes e qualidade mais estável quando uma foto é estendida ou unida.
Cobrança por segundos de vídeo contados (com vídeos de referência = duração do vídeo de referência + duração de saída; senão só a saída):
1) Adicione suas referências — Faça upload de imagens de referência em Imagens (até 9); eles ancoram identidade, guarda-roupa e estilo para Seedance 2.5 Reference to Video. Adicione Vídeos ou Áudio breves referências para orientar o movimento ou o som.
2) Descreva a cena — Escreva o que deve acontecer e como a câmera se comporta (ação do assunto, push-in, panorâmica). Recomenda-se chinês ~≤500 caracteres ou inglês ~≤1000 palavras.
3) Respeite os limites — Os vídeos e áudios de referência devem ter de 2 a 15 segundos cada; áudio com menos de 15 MB.
4) Escolha a proporção — Use adaptive para exploração ou uma proporção fixa (por exemplo 9:16 ou 16:9) para um produto conhecido.
5) Definir duração — Qualquer número inteiro de 4 a 15 segundos no modelo atual.
6) Escolha a resolução — 480p para rascunhos rápidos, 720p para um padrão balanceado, 1080p para detalhes altos ou 4K para a saída mais nítida.
7) Gerar áudio — Deixe habilitado para diálogo, SFX ou música; desative-o quando precisar apenas de vídeo silencioso.
8) Gerar e iterar — Troque referências, refine o prompt ou ajuste a proporção, a duração e a resolução e, em seguida, visualize a experiência do Seedance 2.5.
Crie um vídeo de avatar a partir de um arquivo de imagem e áudio obrigatório, com um prompt de texto opcional para orientação de geração.
Crie vídeos dinâmicos com transições suaves e movimento realista.
Modelo de movimento cinematográfico para criação fluida de cenas e edição visual adaptável.
Processe um vídeo existente com uma faixa de áudio e adicione, se necessário, prompt e seed.
Anime uma imagem de origem obrigatória com um dos 48 efeitos predefinidos e controles de resolução, duração, prompt negativo e otimização.
Sincronize uma faixa de áudio com um vídeo e escolha se o vídeo deve ser repetido.
Sim. O Seedance 2.5 Reference to Video já está disponível no RunComfy. Você pode usá-lo diretamente no navegador ou via API HTTP. Apenas um prompt de texto é obrigatório; imagens, vídeos e áudio de referência são opcionais, mas ajudam a orientar estilo, movimento e clima.
Seedance 2.5 Reference to Video é um modelo multimodal da ByteDance Seed que transforma imagens de referência, vídeos curtos e áudio, junto com um prompt, em um pequeno clipe cinematográfico. Ele tem como alvo criativos de anúncios, pré-visualização de filmes, animação de personagens e narrativa de marca onde a consistência de referência e o áudio nativo são importantes.
Você anexa material de referência – até 9 imagens, 3 vídeos curtos e 3 clipes de áudio – e descreve a cena no prompt. As referências ancoram identidade, guarda-roupa, estilo, movimento e som, enquanto o prompt orienta a ação e a câmera. No modelo atual que alimenta esta página, apenas o prompt é estritamente necessário, mas as referências são o que tornam os resultados da referência ao vídeo consistentes.
O Seedance 2.5 concentra-se na edição de vídeo mais precisa, consistência de referência mais forte e qualidade mais estável quando um clipe é estendido ou agrupado. Ele também visa seguir instruções negativas e de estilo de carimbo de data/hora de maneira mais confiável, melhorar os resultados em vários idiomas e reduzir artefatos de personagens duplicados e marcas d'água perdidas.
Sim. Quando a geração de áudio está habilitada (o padrão atual), o modelo pode gerar vídeo com fala sincronizada, SFX e música, que suporta clipes sincronizados com os lábios. Você pode desativá-lo se precisar apenas de vídeo silencioso. A qualidade da sincronização labial ainda depende da clareza do prompt e da cena que você descreve.
A consistência de referência é o foco principal do Seedance 2.5. Na prática, as imagens de referência e um aviso claro ajudam a ancorar a identidade, o guarda-roupa e o tom nas molduras. No modelo atual que alimenta esta página, você pode anexar imagens, vídeos e áudio de referência dentro dos limites suportados para reforçar a consistência.
Recomenda-se prompts de ~≤500 caracteres em chinês ou ~≤1000 palavras em inglês. Você pode anexar até 20 imagens de referência, 6 vídeos de referência e 6 clipes de áudio de referência. Apenas o prompt é obrigatório; as referências são opcionais, mas recomendadas para resultados consistentes.
As opções de resolução são 480p, 720p (padrão), 1080p e 4K. A proporção pode ser adaptive (padrão, onde o modelo escolhe a proporção mais próxima) ou fixada em 16:9, 9:16, 4:3, 3:4, 1:1 ou 21:9. A duração é um número inteiro de segundos de 4 a 15 no modelo atual, com padrão 5.
A cobrança é baseada na duração do vídeo gerado, sem vídeos de referência a US$ 0,42/s e com vídeos de referência a US$ 0,26/s contado (duração do vídeo de referência + saída). Consulte a seção Geração nesta página para preços em tempo real.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.





