Transforme um retrato e uma trilha de áudio em um vídeo de avatar falante, com um prompt opcional para orientar movimento ou modo de falar.
Kling V3.0 4K é a versão nativa em 4K do modelo multimodal de geração de vídeo Kling V3.0 disponível no RunComfy. Ela transforma prompts de texto em clipes cinematográficos de resolução ultra-alta a 3840×2160, mantendo o sequenciamento multi-shot, o áudio sincronizado e o controle profissional de câmera das outras variantes V3.0. Foi criada para entregas em qualidade master que não precisam de upscaling na pós-produção.
Formato de saída: 4K nativo (3840×2160) / 3–15 s / 16:9, 9:16, 1:1 / áudio sincronizado opcional
| Parâmetro | Obrigatório | Tipo | Padrão | Intervalo / Opções | Descrição |
|---|---|---|---|---|---|
| prompt* | Sim (*) | string | — | — | Descrição da cena, do movimento, do estilo de câmera e da atmosfera. |
| negative_prompt | Não | string | — | — | Elementos a excluir do vídeo. |
| duration | Não | number (seconds) | 5 | 3–15 | Duração do vídeo em segundos. |
| aspect_ratio | Não | enum | 16:9 | 16:9, 9:16, 1:1 | Proporção do vídeo. |
| cfg_scale | Não | number | 0.5 | — | Intensidade com que o resultado deve seguir o prompt. |
| sound | Não | boolean | disabled | enabled/disabled | Gera áudio sincronizado junto com o vídeo. |
| multi_prompt | Não | array/string | — | — | Prompts adicionais para compor cenas complexas. |
| Unidade de cobrança | Áudio | Tarifa |
|---|---|---|
| Por segundo gerado | Desativado | $0.42 por segundo |
| Por segundo gerado | Ativado | $0.42 por segundo |
Kling V3.0 4K aplica a mesma tarifa fixa por segundo, com ou sem áudio.
Transforme um retrato e uma trilha de áudio em um vídeo de avatar falante, com um prompt opcional para orientar movimento ou modo de falar.
Gere um vídeo de 5 ou 10 segundos a partir de um prompt obrigatório. Opcionalmente, adicione uma trilha de áudio WAV ou MP3, um prompt negativo e um dos 13 tamanhos de saída.
Gere clipes cinematográficos com mais rapidez usando referências multimodais, sincronização labial e controle de câmera.
Crie vídeos fluidos e realistas a partir de duas imagens com alta fidelidade
Transforme imagens em vídeos realistas com fluidez e alta definição
Anime uma imagem de personagem de referência com movimento de um vídeo de direção, mantendo o personagem reconhecível.
Kling V3.0 4K Text-to-Video é a versão nativa em 4K da família. Ao contrário das versões Standard e Pro, ela renderiza diretamente em 3840×2160 em uma única etapa, sem upscaling, preservando melhor texturas, bordas e detalhes em movimento mesmo em telas grandes. A arquitetura multi-shot, o áudio sincronizado e os parâmetros são os mesmos das outras variantes.
Sim. Kling V3.0 4K Text-to-Video gera diretamente em 3840×2160 (UHD 4K), independentemente da proporção selecionada. Não há etapa de upscaling: detalhes como poros da pele, tramas de tecidos e reflexos de lente são criados na resolução 4K completa.
Muitos modelos concorrentes, entre eles Seedance 1.0 Pro e Wan 2.5, chegam nativamente a 1080p e usam upscaling para resoluções maiores. Kling V3.0 4K Text-to-Video gera diretamente em 4K nativo, com maior coerência temporal em sequências multi-shot e sincronização mais precisa entre áudio e vídeo. Outros modelos ainda podem se destacar em estilos específicos, mas Kling leva vantagem quando a entrega exige alta resolução nativa.
Cada geração de Kling V3.0 4K Text-to-Video dura até cerca de 15 segundos e pode incluir até seis tomadas contínuas. A resolução nativa é 3840×2160; as proporções normalmente incluem 16:9, 9:16 e 1:1. Os prompts costumam aceitar até 1,200 tokens, e o número de referências depende da configuração do node. A geração em 4K nativo também leva mais tempo do que nas versões Standard e Pro.
Sim. Kling V3.0 4K Text-to-Video pode encadear até seis tomadas em um clipe 4K coerente usando o recurso multi-shot da família V3.0. Você pode definir tipos de tomada, ângulos e transições no prompt ou por multi_prompt no RunComfy Playground. O sistema mantém a iluminação e a continuidade dos personagens entre as tomadas em resolução 4K completa.
Depois de validar o fluxo do Kling V3.0 4K Text-to-Video no RunComfy Playground, use a API do RunComfy. Ela oferece as mesmas configurações, incluindo definições de tomadas, segmentos de múltiplos prompts e controle de áudio, por endpoints REST autenticados. Você precisa gerar uma chave de API, ter créditos USD suficientes e gerenciar a recuperação assíncrona do vídeo na fila de tarefas.
Sim. Kling V3.0 4K Text-to-Video inclui síntese de áudio e sincronização labial dinâmica em inglês, chinês, japonês, coreano e espanhol. Quando o prompt descreve um diálogo, a fala e o movimento da boca são sincronizados na mesma geração em 4K, sem uma etapa separada de dublagem.
Com Kling V3.0 4K Text-to-Video, você pode especificar movimentos profissionais como pan, dolly, tilt e POV diretamente no prompt. Em 4K nativo, profundidade de paralaxe, reflexos de lente e equilíbrio da composição ficam mais definidos do que nas variantes em 1080p, oferecendo maior controle cinematográfico para masters finais.
Kling V3.0 4K Text-to-Video custa sempre $0.42 por segundo, com ou sem áudio. A versão Standard custa $0.084 por segundo sem áudio e $0.126 por segundo com áudio; a versão Pro custa $0.112 por segundo sem áudio e $0.168 por segundo com áudio. A tarifa 4K reflete o maior custo computacional de renderizar cada quadro a 3840×2160.
O uso comercial dos resultados de Kling V3.0 4K Text-to-Video depende da licença publicada pela Kuaishou Technology e dos termos de serviço do RunComfy. Em geral, os vídeos podem ser usados em marketing e projetos criativos, mas verifique as cláusulas de uso comercial e possíveis exigências de atribuição antes da publicação.
Não para quem usa o RunComfy Playground: Kling V3.0 4K Text-to-Video é renderizado na nuvem, então não é necessária uma GPU local compatível com 4K. Pela API, espere maior latência do que nas versões Standard e Pro por causa da quantidade de pixels em cada quadro. Prompts objetivos, clipes de duração moderada e templates reutilizáveis ajudam a reduzir tempo e custo.
RunComfy é a principal ComfyUI plataforma, oferecendo ComfyUI online ambiente e serviços, juntamente com fluxos de trabalho do ComfyUI apresentando visuais impressionantes. RunComfy também oferece AI Models, permitindo que artistas utilizem as mais recentes ferramentas de AI para criar arte incrível.





