Substitua uma área selecionada de um vídeo usando uma máscara ou descrição, com imagem e prompt opcionais.
Wan 3.0 Text To Video lê uma descrição em linguagem simples e retorna um pequeno clipe cinematográfico. Você descreve o assunto, a ação, a câmera e a luz; o modelo compõe a cena, conduz o movimento e pode adicionar áudio correspondente em uma única passagem.
Esta página cobre o endpoint somente texto da família Wan 3.0. Não há imagem para carregar, por isso é uma maneira rápida de explorar uma ideia, bloquear uma cena ou produzir um pequeno plano finalizado apenas com palavras.
| Parâmetro | Obrigatório | Tipo | Padrão | Gama / Opções | Descrição |
|---|---|---|---|---|---|
| alerta* | Sim (*) | corda | - | - | Cena, assunto, ação, câmera, iluminação e movimento. |
| resolução | Não | corda | 720p | 480p, 720p, 1080p | Camada de resolução de saída. |
| aspect_ratio | Não | corda | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, adaptive | Proporção de aspecto de saída. |
| duração | Não | inteiro | 5 | 2-30 | Duração da saída em segundos. |
| thinking_mode | Não | booleano | falso | verdadeiro/falso | Interpretação mais profunda para solicitações complexas. |
| enable_audio | Não | booleano | verdade | verdadeiro/falso | Inclui uma trilha de áudio sincronizada. |
| semente | Não | inteiro | aleatório | 0-2147483647 | Semente para resultados reproduzíveis. |
O preço depende da resolução escolhida: US$ 0,06 por segundo em 480p, US$ 0,12 por segundo em 720p e US$ 0,25 por segundo em 1080p. Ativar ou desativar o áudio não altera a taxa.
Substitua uma área selecionada de um vídeo usando uma máscara ou descrição, com imagem e prompt opcionais.
Crie um vídeo a partir de um prompt de texto e de um a três clipes de referência, com controles de duração, tamanho de saída, estrutura da cena, semente, prompt negativo e geração de áudio.
Transforme imagens em vídeos 2K fluidos e realistas com a potência criativa do Dreamina 3.0.
Anime uma imagem estática e transforme-a em um vídeo curto com áudio sincronizado.
Gere um vídeo a partir de uma imagem de retrato obrigatória e uma trilha de áudio obrigatória com menos de 35 segundos. Adicione orientação opcional em seis idiomas suportados e use o controle inicial, cujo padrão é -1.
FLUX 3 Draft Keyframes: Pré-visualizações rápidas de vídeo com vários quadros-chave em 720p
Wan 3.0 Text To Video gera um pequeno clipe cinematográfico diretamente de um prompt escrito, sem necessidade de imagem de referência. É útil para pré-visualização de conceitos, fotos de anúncios e promoções e vídeos sociais, permitindo que você visualize uma ideia em minutos apenas com palavras.
O ponto final de texto para vídeo começa apenas com um prompt, de modo que o modelo compõe toda a cena, enquanto o ponto final de imagem para vídeo anima um primeiro quadro específico que você fornece. Escolha Wan 3.0 Text To Video quando quiser que o modelo invente o enquadramento e imagem para vídeo quando já tiver a cena de abertura.
Wan 3.0 Text To Video segue instruções estruturadas que nomeiam o assunto, a ação, o movimento da câmera e a iluminação, e produz um movimento coerente, semelhante ao de um filme. Avisos claros e concretos com uma única direção de câmera por foto geralmente fornecem os resultados mais previsíveis.
Ele suporta saída 480p, 720p e 1080p, duração de 2 a 30 segundos e proporções de aspecto incluindo 16:9, 9:16, 1:1, 4:3 e 3:4. Use 480p para rascunhos rápidos e 1080p para entrega; verifique o painel RunComfy para obter os limites atuais exatos.
Sim. Wan 3.0 Text To Video pode gerar uma trilha de áudio sincronizada com o vídeo e você pode desativar o áudio para uma exportação silenciosa. A ativação ou desativação do áudio não afeta o preço.
O modo de pensamento permite uma interpretação mais deliberada do prompt, o que pode ajudar quando uma cena combina diversas ações, assuntos ou regras de composição. É opcional e desativado por padrão, portanto, você pode ativá-lo para solicitações complexas e deixá-lo desativado para solicitações simples.
Sim. Você pode prototipar Wan 3.0 Text To Video na UI do modelo RunComfy e depois chamar o mesmo modelo por meio de RunComfy HTTP API com os mesmos parâmetros. Isso facilita a passagem do teste do navegador para um fluxo de trabalho de produção automatizado.
As gerações consomem dólares ou créditos com base na resolução e duração: US$ 0,06 por segundo em 480p, US$ 0,12 por segundo em 720p e US$ 0,25 por segundo em 1080p. Novos usuários geralmente recebem um valor de teste gratuito para testar Wan 3.0 Text To Video primeiro.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.





