Anime uma imagem inicial obrigatória com um prompt obrigatório usando Kling 2.1 Pro, com uma imagem final opcional, duração, proporção de aspecto, prompt negativo e intensidade do prompt.
Wan 3.0 Text To Video lê uma descrição em linguagem simples e retorna um pequeno clipe cinematográfico. Você descreve o assunto, a ação, a câmera e a luz; o modelo compõe a cena, conduz o movimento e pode adicionar áudio correspondente em uma única passagem.
Esta página cobre o endpoint somente texto da família Wan 3.0. Não há imagem para carregar, por isso é uma maneira rápida de explorar uma ideia, bloquear uma cena ou produzir um pequeno plano finalizado apenas com palavras.
| Parâmetro | Obrigatório | Tipo | Padrão | Gama / Opções | Descrição |
|---|---|---|---|---|---|
| alerta* | Sim (*) | corda | - | - | Cena, assunto, ação, câmera, iluminação e movimento. |
| resolução | Não | corda | 720p | 480p, 720p, 1080p | Camada de resolução de saída. |
| aspect_ratio | Não | corda | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, adaptive | Proporção de aspecto de saída. |
| duração | Não | inteiro | 5 | 2-30 | Duração da saída em segundos. |
| enable_audio | Não | booleano | verdade | verdadeiro/falso | Inclui uma trilha de áudio sincronizada. |
| semente | Não | inteiro | aleatório | 0-2147483647 | Semente para resultados reproduzíveis. |
O preço depende da resolução escolhida: US$ 0,06 por segundo em 480p, US$ 0,12 por segundo em 720p e US$ 0,25 por segundo em 1080p. Ativar ou desativar o áudio não altera a taxa.
Anime uma imagem inicial obrigatória com um prompt obrigatório usando Kling 2.1 Pro, com uma imagem final opcional, duração, proporção de aspecto, prompt negativo e intensidade do prompt.
Transforme um clipe de origem com um prompt de texto e áudio nativo.
LTX 2.5 Fast texto para vídeo com rascunhos AV sincronizados até 4K
Wan 3.0 Prime Text To Video cria clipes de prompts rapidamente
Substitua uma área selecionada de um vídeo usando uma máscara ou descrição, com imagem e prompt opcionais.
MiniMax H3: texto para vídeo 768p/2K com áudio estéreo nativo
Wan 3.0 Text To Video gera um pequeno clipe cinematográfico diretamente de um prompt escrito, sem necessidade de imagem de referência. É útil para pré-visualização de conceitos, fotos de anúncios e promoções e vídeos sociais, permitindo que você visualize uma ideia em minutos apenas com palavras.
O ponto final de texto para vídeo começa apenas com um prompt, de modo que o modelo compõe toda a cena, enquanto o ponto final de imagem para vídeo anima um primeiro quadro específico que você fornece. Escolha Wan 3.0 Text To Video quando quiser que o modelo invente o enquadramento e imagem para vídeo quando já tiver a cena de abertura.
Wan 3.0 Text To Video segue instruções estruturadas que nomeiam o assunto, a ação, o movimento da câmera e a iluminação, e produz um movimento coerente, semelhante ao de um filme. Avisos claros e concretos com uma única direção de câmera por foto geralmente fornecem os resultados mais previsíveis.
Ele suporta saída 480p, 720p e 1080p, duração de 2 a 30 segundos e proporções de aspecto incluindo 16:9, 9:16, 1:1, 4:3 e 3:4. Use 480p para rascunhos rápidos e 1080p para entrega; verifique o painel RunComfy para obter os limites atuais exatos.
Sim. Wan 3.0 Text To Video pode gerar uma trilha de áudio sincronizada com o vídeo e você pode desativar o áudio para uma exportação silenciosa. A ativação ou desativação do áudio não afeta o preço.
O modo de pensamento permite uma interpretação mais deliberada do prompt, o que pode ajudar quando uma cena combina diversas ações, assuntos ou regras de composição. É opcional e desativado por padrão, portanto, você pode ativá-lo para solicitações complexas e deixá-lo desativado para solicitações simples.
Sim. Você pode prototipar Wan 3.0 Text To Video na UI do modelo RunComfy e depois chamar o mesmo modelo por meio de RunComfy HTTP API com os mesmos parâmetros. Isso facilita a passagem do teste do navegador para um fluxo de trabalho de produção automatizado.
As gerações consomem dólares ou créditos com base na resolução e duração: US$ 0,06 por segundo em 480p, US$ 0,12 por segundo em 720p e US$ 0,25 por segundo em 1080p. Novos usuários geralmente recebem um valor de teste gratuito para testar Wan 3.0 Text To Video primeiro.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.





