logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Wan 2.2 S2V: Gerador de voz para vídeo | RunComfy

wan-ai/wan-2-2/speech-to-video

Combine uma imagem e um arquivo de áudio para criar um vídeo de personagem falando, cantando ou atuando em 480P ou 720P.

Imagem JPG, JPEG, PNG, BMP ou WEBP necessária. A largura e a altura devem ser superiores a 400 pixels e não podem ultrapassar 7.000 pixels.
0:00
0:00
Áudio WAV ou MP3 necessário com menos de 20 segundos e menos de 15 MB.
Escolha fala, canto ou performance; padrão: fala.
Escolha saída 480P ou 720P; padrão: 480P.
Idle
The rate is $0.10 per second for 480P, and $0.20 per second for 720P.

Visão geral do Wan 2.2 S2V

Wan 2.2 S2V transforma uma imagem estática e uma trilha de áudio obrigatórias em um vídeo de personagem. Selecione fala, canto ou performance de acordo com a gravação e escolha a resolução 480P ou 720P. Os campos de imagem e áudio têm limites de formato, dimensões, duração e tamanho de arquivo.

Recursos do Wan 2.2 S2V

Entrada de imagem e áudio

Crie um vídeo a partir de uma imagem e um arquivo de áudio obrigatórios, sem precisar de um prompt de texto.

Movimento de personagem baseado em áudio

Use a gravação para conduzir um vídeo de personagem, com um modo selecionado para fala, canto ou uma performance mais ampla.

Três modos de animação

Escolha fala para diálogos, canto para vocais ou performance para uma animação mais ampla do personagem; fala é o padrão.

Duas resoluções de saída

Gere em 480P por padrão ou selecione 720P quando for necessária uma resolução de saída mais alta.

Wan 2.2 S2V notícias e exemplos no X

Modelos Relacionados

bytedance/upscale/video

Amplie um vídeo de origem para a resolução e a taxa de quadros selecionadas.

infinite-talk/fast

Gere um vídeo a partir de uma faixa de áudio e uma imagem, com prompt e seed opcionais.

wan-2-6/video-to-video

Crie um vídeo a partir de um prompt de texto e de um a três clipes de referência, com controles de duração, tamanho de saída, estrutura da cena, semente, prompt negativo e geração de áudio.

seedance-v1.5-pro/text-to-video

Gere vídeos de 4 a 12 segundos a partir de texto em 480p, 720p ou 1080p, com seis proporções de aspecto, além de áudio e controles de câmera fixa.

dreamina-3-0/pro/image-to-video

Transforme imagens estáticas em vídeos realistas e detalhados em 2K.

minimax-h3-open/text-to-video

Texto para vídeo de peso aberto com 480p/768p e áudio estéreo nativo.

Perguntas Frequentes

Quais entradas Wan 2.2 S2V requer?

Requer uma imagem e um arquivo de áudio. Nenhum prompt de texto é exposto nesta interface.

Quais formatos de imagem são suportados?

Use JPG, JPEG, PNG, BMP ou WEBP. A largura e a altura da imagem devem ser superiores a 400 pixels e não podem ultrapassar 7.000 pixels.

Quais são os requisitos de áudio?

Use áudio WAV ou MP3 com menos de 20 segundos. O arquivo também deve ser menor que 15 MB.

Quais modos de animação estão disponíveis?

Escolha fala, canto ou performance. A fala é o padrão.

Quais resoluções posso gerar?

Escolha 480P ou 720P. O padrão é 480P.

Quanto custa a geração?

Um vídeo de 5 segundos requer 68 créditos.

Quando devo escolher falar, cantar ou atuar?

Escolha fala para diálogos, canto para vocais e performance para uma animação mais ampla do personagem, não limitada a falar ou cantar.

Por que um upload pode ser rejeitado?

Verifique o tipo de arquivo e os limites suportados. As imagens devem atender a ambas as regras de dimensão, enquanto o áudio deve atender às regras de formato, duração e tamanho do arquivo.

O Wan 2.2 S2V aceita geração em lote?

Sim. Os tamanhos de lote aceitos são 1, 2, 3 e 4 tarefas.

O modo de atuação altera os requisitos de imagem e áudio?

Não. Os modos speech, sing e perform usam os mesmos limites de formato, dimensões, duração e tamanho de arquivo.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...