logo
RunComfy
  • ComfyUI
  • TreinadorNovo
  • Modelos
  • API
  • Preços
discord logo
MODELOS
Explorar
Todos os modelos
BIBLIOTECA
Gerações
APIS DE MODELOS
Documentação da API
Chaves API
CONTA
Uso

Wan 3.0 Text To Video: Geração cinematográfica de prompt para clipe em Models and API | RunComfy

wan-ai/wan-3.0/text-to-video

Wan 3.0 Text To Video transforma um prompt de linguagem natural em um clipe cinematográfico coerente com duração flexível, proporção de aspecto e áudio sincronizado opcional.

Descreva a cena, o assunto, a ação, o movimento da câmera, a iluminação e o movimento que você deseja gerar.
Camada de resolução de saída. Use 480p para rascunhos rápidos e 1080p para resultados de maior qualidade.
Proporção de aspecto de saída do vídeo gerado.
Duração do vídeo gerado em segundos. O intervalo é 2-30. Comece curto para iterar e aumente quando o movimento parecer correto.
When on, the model may rewrite your prompt for richer scene detail before generation. Turn off for faster turnaround if your prompt is already precise.
Quando ativado, o vídeo de saída inclui uma trilha de áudio sincronizada. Desligue para um clipe silencioso.
Semente aleatória para resultados reproduzíveis. O intervalo é de 0 a 2147483647.
Idle
The rate is $0.049 per second for 480p, $0.099 per second for 720p, and $0.199 per second for 1080p.

Introdução ao Wan 3.0 Text To Video

Wan 3.0 Text To Video gera um clipe cinematográfico direto de uma cena escrita, com duração de 2 a 30 segundos, controle de proporção, áudio opcional e um modo de pensamento para uma leitura imediata mais deliberada. Trocando storyboards e filmagens por tomadas orientadas, ajuda profissionais de marketing, cineastas e equipes sociais a visualizar ideias em minutos. Para desenvolvedores, Wan 3.0 Text To Video em RunComfy pode ser usado tanto no navegador quanto por meio de um HTTP API, portanto você não precisa hospedar ou dimensionar o modelo sozinho.
Ideal para: Conceito Previz | Fotos publicitárias e promocionais | Vídeo social vertical

Wan-AI / Wan 3.0 Text To Video#


Wan 3.0 Text To Video lê uma descrição em linguagem simples e retorna um pequeno clipe cinematográfico. Você descreve o assunto, a ação, a câmera e a luz; o modelo compõe a cena, conduz o movimento e pode adicionar áudio correspondente em uma única passagem.


Esta página cobre o endpoint somente texto da família Wan 3.0. Não há imagem para carregar, por isso é uma maneira rápida de explorar uma ideia, bloquear uma cena ou produzir um pequeno plano finalizado apenas com palavras.


Destaques#


  • Prompt-to-clip: Gere uma imagem completa a partir do texto, sem necessidade de imagem de referência.
  • Movimento cinematográfico: Direcione os movimentos da câmera e a ação do assunto por meio do prompt para obter resultados coerentes e semelhantes aos de um filme.
  • Comprimento flexível: Escolha de 2 a 30 segundos, para que testes rápidos e testes únicos mais longos sejam adequados.
  • Controle de proporção: Renderize 16:9, 9:16, 1:1, 4:3 ou 3:4 para qualquer posicionamento.
  • Áudio opcional: Adicione uma faixa sincronizada ou exporte um clipe silencioso.

Parâmetros#


ParâmetroObrigatórioTipoPadrãoGama / OpçõesDescrição
alerta*Sim (*)corda--Cena, assunto, ação, câmera, iluminação e movimento.
resoluçãoNãocorda720p480p, 720p, 1080pCamada de resolução de saída.
aspect_ratioNãocorda16:916:9, 9:16, 1:1, 4:3, 3:4, adaptiveProporção de aspecto de saída.
duraçãoNãointeiro52-30Duração da saída em segundos.
enable_audioNãobooleanoverdadeverdadeiro/falsoInclui uma trilha de áudio sincronizada.
sementeNãointeiroaleatório0-2147483647Semente para resultados reproduzíveis.

Preços#


O preço depende da resolução escolhida: US$ 0,06 por segundo em 480p, US$ 0,12 por segundo em 720p e US$ 0,25 por segundo em 1080p. Ativar ou desativar o áudio não altera a taxa.

Modelos relacionados

kling-2-1/pro/image-to-video

Anime uma imagem inicial obrigatória com um prompt obrigatório usando Kling 2.1 Pro, com uma imagem final opcional, duração, proporção de aspecto, prompt negativo e intensidade do prompt.

seedance-2.0-mini/video-to-video

Transforme um clipe de origem com um prompt de texto e áudio nativo.

ltx-2.5/text-to-video/fast

LTX 2.5 Fast texto para vídeo com rascunhos AV sincronizados até 4K

wan-3.0-prime/text-to-video

Wan 3.0 Prime Text To Video cria clipes de prompts rapidamente

pikaswaps

Substitua uma área selecionada de um vídeo usando uma máscara ou descrição, com imagem e prompt opcionais.

minimax-h3/text-to-video

MiniMax H3: texto para vídeo 768p/2K com áudio estéreo nativo

Perguntas Frequentes

Para que é usado Wan 3.0 Text To Video?

Wan 3.0 Text To Video gera um pequeno clipe cinematográfico diretamente de um prompt escrito, sem necessidade de imagem de referência. É útil para pré-visualização de conceitos, fotos de anúncios e promoções e vídeos sociais, permitindo que você visualize uma ideia em minutos apenas com palavras.

Qual a diferença entre Wan 3.0 Text To Video e o endpoint de imagem para vídeo?

O ponto final de texto para vídeo começa apenas com um prompt, de modo que o modelo compõe toda a cena, enquanto o ponto final de imagem para vídeo anima um primeiro quadro específico que você fornece. Escolha Wan 3.0 Text To Video quando quiser que o modelo invente o enquadramento e imagem para vídeo quando já tiver a cena de abertura.

Quão boa é a adesão imediata e a qualidade do movimento em Wan 3.0 Text To Video?

Wan 3.0 Text To Video segue instruções estruturadas que nomeiam o assunto, a ação, o movimento da câmera e a iluminação, e produz um movimento coerente, semelhante ao de um filme. Avisos claros e concretos com uma única direção de câmera por foto geralmente fornecem os resultados mais previsíveis.

Quais resoluções, durações e proporções são suportadas por Wan 3.0 Text To Video?

Ele suporta saída 480p, 720p e 1080p, duração de 2 a 30 segundos e proporções de aspecto incluindo 16:9, 9:16, 1:1, 4:3 e 3:4. Use 480p para rascunhos rápidos e 1080p para entrega; verifique o painel RunComfy para obter os limites atuais exatos.

Wan 3.0 Text To Video pode adicionar áudio ao clipe?

Sim. Wan 3.0 Text To Video pode gerar uma trilha de áudio sincronizada com o vídeo e você pode desativar o áudio para uma exportação silenciosa. A ativação ou desativação do áudio não afeta o preço.

O que é o modo de pensamento em Wan 3.0 Text To Video?

O modo de pensamento permite uma interpretação mais deliberada do prompt, o que pode ajudar quando uma cena combina diversas ações, assuntos ou regras de composição. É opcional e desativado por padrão, portanto, você pode ativá-lo para solicitações complexas e deixá-lo desativado para solicitações simples.

Os desenvolvedores podem chamar Wan 3.0 Text To Video por meio da API RunComfy?

Sim. Você pode prototipar Wan 3.0 Text To Video na UI do modelo RunComfy e depois chamar o mesmo modelo por meio de RunComfy HTTP API com os mesmos parâmetros. Isso facilita a passagem do teste do navegador para um fluxo de trabalho de produção automatizado.

Quanto custa Wan 3.0 Text To Video em RunComfy?

As gerações consomem dólares ou créditos com base na resolução e duração: US$ 0,06 por segundo em 480p, US$ 0,12 por segundo em 720p e US$ 0,25 por segundo em 1080p. Novos usuários geralmente recebem um valor de teste gratuito para testar Wan 3.0 Text To Video primeiro.

Siga-nos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Suporte
  • Discord
  • E-mail
  • Status do Sistema
  • afiliado
Modelos de Vídeo
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • Ver todos os modelos →
Modelos de Imagem
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • Ver todos os modelos →
Legal
  • Termos de Serviço
  • Política de Privacidade
  • Política de Cookies
RunComfy
Copyright 2026 RunComfy. Todos os Direitos Reservados.

RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.

Exemplos de Wan 3.0 Text To Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...