logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Wan 2.2 S2V: Gerador de voz para vídeo | RunComfy

wan-ai/wan-2-2/speech-to-video

Combine uma imagem e um arquivo de áudio para criar um vídeo de personagem falando, cantando ou atuando em 480P ou 720P.

Imagem JPG, JPEG, PNG, BMP ou WEBP necessária. A largura e a altura devem ser superiores a 400 pixels e não podem ultrapassar 7.000 pixels.
0:00
0:00
Áudio WAV ou MP3 necessário com menos de 20 segundos e menos de 15 MB.
Escolha fala, canto ou performance; padrão: fala.
Escolha saída 480P ou 720P; padrão: 480P.
Idle
The rate is $0.10 per second for 480P, and $0.20 per second for 720P.

Visão geral do Wan 2.2 S2V

Wan 2.2 S2V transforma uma imagem estática e uma trilha de áudio obrigatórias em um vídeo de personagem. Selecione fala, canto ou performance de acordo com a gravação e escolha a resolução 480P ou 720P. Os campos de imagem e áudio têm limites de formato, dimensões, duração e tamanho de arquivo.

Recursos do Wan 2.2 S2V

Entrada de imagem e áudio

Crie um vídeo a partir de uma imagem e um arquivo de áudio obrigatórios, sem precisar de um prompt de texto.

Movimento de personagem baseado em áudio

Use a gravação para conduzir um vídeo de personagem, com um modo selecionado para fala, canto ou uma performance mais ampla.

Três modos de animação

Escolha fala para diálogos, canto para vocais ou performance para uma animação mais ampla do personagem; fala é o padrão.

Duas resoluções de saída

Gere em 480P por padrão ou selecione 720P quando for necessária uma resolução de saída mais alta.

Wan 2.2 S2V notícias e exemplos no X

Modelos Relacionados

pixverse/v5.5/effects

Anime uma imagem de origem obrigatória com um dos 48 efeitos predefinidos e controles de resolução, duração, prompt negativo e otimização.

flux-3/text-to-video

FLUX 3 Video transforma prompts de texto em clipes cinematográficos com áudio nativo

happyhorse-1.1/image-to-video

Anime uma foto estática em um vídeo fluido de 720P ou 1080P a partir de um único prompt.

seedance-2.0-mini/text-to-video

Modelo de vídeo IA rápido e econômico, com vários planos, áudio nativo e referências.

minimax-h3/image-to-video

Anime uma imagem do primeiro quadro em vídeo 768p ou 2K por até 15 segundos

video-background-removal/video-to-video

Separe pessoas ou objetos do fundo do vídeo e configure codec, refinamento de bordas e tipo de objeto.

Perguntas Frequentes

Quais entradas Wan 2.2 S2V requer?

Requer uma imagem e um arquivo de áudio. Nenhum prompt de texto é exposto nesta interface.

Quais formatos de imagem são suportados?

Use JPG, JPEG, PNG, BMP ou WEBP. A largura e a altura da imagem devem ser superiores a 400 pixels e não podem ultrapassar 7.000 pixels.

Quais são os requisitos de áudio?

Use áudio WAV ou MP3 com menos de 20 segundos. O arquivo também deve ser menor que 15 MB.

Quais modos de animação estão disponíveis?

Escolha fala, canto ou performance. A fala é o padrão.

Quais resoluções posso gerar?

Escolha 480P ou 720P. O padrão é 480P.

Quanto custa a geração?

Um vídeo de 5 segundos requer 68 créditos.

Quando devo escolher falar, cantar ou atuar?

Escolha fala para diálogos, canto para vocais e performance para uma animação mais ampla do personagem, não limitada a falar ou cantar.

Por que um upload pode ser rejeitado?

Verifique o tipo de arquivo e os limites suportados. As imagens devem atender a ambas as regras de dimensão, enquanto o áudio deve atender às regras de formato, duração e tamanho do arquivo.

O Wan 2.2 S2V aceita geração em lote?

Sim. Os tamanhos de lote aceitos são 1, 2, 3 e 4 tarefas.

O modo de atuação altera os requisitos de imagem e áudio?

Não. Os modos speech, sing e perform usam os mesmos limites de formato, dimensões, duração e tamanho de arquivo.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos os modelos →
Modelos de Imagem
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...