logo
RunComfy
  • ComfyUI
  • EntrenadorNuevo
  • Modelos
  • API
  • Precios
discord logo
MODELOS
Explorar
Todos los modelos
BIBLIOTECA
Generaciones
APIS DE MODELOS
Documentación de la API
Claves API
CUENTA
Uso

PixVerse 5.5 Text-to-Video: audio y control multiclip | RunComfy

pixverse/pixverse/v5.5/text-to-video

Crea un vídeo desde texto con controles precisos de formato, resolución, duración, estilo, semilla, audio, varios clips y optimización del prompt.

Descripción de texto obligatoria del tema, acción, configuración, comportamiento de la cámara y resultado deseado.
Relación de aspecto del vídeo. Los valores exactos son `16:9`, `4:3`, `1:1`, `3:4` y `9:16`.
Resolución de vídeo. Los valores exactos son `360p`, `540p`, `720p` y `1080p`.
Duración del vídeo en segundos. Los valores exactos son 5, 8 y 10; `1080p` está limitado a 5 u 8 segundos.
Texto opcional que describe elementos o artefactos que se deben evitar.
Estilo preestablecido. Los valores exactos son `anime`, `3d_animation`, `clay`, `comic` y `cyberpunk`.
Semilla entera utilizada para comparaciones repetibles.
Permite la generación de BGM, efectos de sonido o diálogos.
Permite la generación de múltiples clips con cambios dinámicos de cámara.
Modo de optimización del prompt: `enabled`, `disabled` o `auto`.
Idle
Pricing starts at $0.38 for a 5-second 360p/540p clip; 720p is $0.44, 1080p is $0.69. For 8-second videos, costs 1.6×; for 10-second videos, costs are double the 5-second base.

Introducción a PixVerse 5.5 Text-to-Video

PixVerse 5.5 Text-to-Video genera un vídeo a partir de un `prompt` obligatorio. Ofrece cinco valores `aspect_ratio`, cuatro valores `resolution`, `duration` de 5, 8 o 10 segundos, un `negative_prompt` opcional, cinco ajustes preestablecidos `style`, un número entero `seed`, generación de audio opcional, generación de múltiples clips opcional y tres modos `thinking_type`. En `1080p`, la duración está limitada a 5 u 8 segundos. Esta página no tiene entrada de imagen.

PixVerse 5.5 Text-to-Video descripción general#


PixVerse 5.5 Text-to-Video utiliza un prompt obligatorio para generar un video. Sus controles definen el encuadre, la resolución, la duración, las exclusiones, el estilo visual, la semilla aleatoria, el audio, el comportamiento de múltiples clips y la optimización del prompt.


Entradas y controles#


ParámetroObligatorioPredeterminado/opcionesQué controla
promptSíPrompt de ejemploAsunto, escenario, acción, comportamiento de la cámara, ritmo y detalles visuales.
aspect_ratioNoPredeterminado 16:9Valores exactos: 16:9, 4:3, 1:1, 3:4, 9:16.
resolutionNoPredeterminado 720pValores exactos: 360p, 540p, 720p, 1080p.
durationNoPredeterminado 5Valores exactos: 5, 8 o 10 segundos. En 1080p, utilice 5 u 8 segundos.
negative_promptNoVacíoElementos, estilos o artefactos a evitar.
styleNoPredeterminado animeValores exactos: anime, 3d_animation, clay, comic, cyberpunk.
seedNoPredeterminado 0Semilla entera para iteraciones comparables o repetibles; no se documenta ningún mínimo ni máximo.
generate_audio_switchNoPredeterminado falseHabilita música de fondo, efectos de sonido o generación de diálogos.
generate_multi_clip_switchNoPredeterminado falsePermite múltiples clips con cambios dinámicos de cámara.
thinking_typeNoPredeterminado autoValores exactos: enabled, disabled, auto.

Flujo de trabajo recomendado#


  1. En prompt, indique el tema, el escenario, la acción, el comportamiento de la cámara, el ritmo y el estilo visual.
  2. Seleccione aspect_ratio, resolution y duration; recuerda que 1080p solo admite 5 u 8 segundos.
  3. Agregue un negative_prompt enfocado, elija un style y mantenga seed fijo mientras compara la configuración.
  4. Active generate_audio_switch solo cuando desee audio y habilite generate_multi_clip_switch cuando cambie la cámara dinámica o se necesiten varios clips.
  5. Elija thinking_type como auto, enabled o disabled según el comportamiento de optimización deseado.

Alcance y limitaciones#


  • Esta página acepta solo texto y no tiene ningún campo de imagen de origen o de imagen de referencia.
  • La generación de audio y múltiples clips está predeterminada en false; ninguno es automático.
  • El esquema no expone dimensiones personalizadas, velocidad de fotogramas, formato de salida, controles de cámara dedicados ni un límite de longitud de prompts.
  • duration acepta 10 segundos en resoluciones más bajas, pero no en 1080p.
  • El esquema no garantiza sincronización labial, consistencia de personajes, coherencia narrativa o reproducibilidad exacta.

Modelo relacionado#


PixVerse 5.5 Image-to-Video

Modelos relacionados

hunyuan/image-to-video

Transforma imágenes en videos fluidos con escenas naturales y movimiento coherente.

hailuo-02/pro/text-to-video

Cree un vídeo de seis segundos a partir de un prompt de texto requerido con Hailuo 02 Pro y una expansión del prompt opcional.

happyhorse-1.1/image-to-video

Anima una foto y crea un video fluido en 720P o 1080P con un solo prompt.

ltx-2-19b/text-to-video/lora

Crea clips sincronizados a partir de prompts con control preciso del audio y del estilo mediante LoRA.

seedance-v1.5-pro/image-to-video

Transforma imágenes estáticas en clips de video cinematográficos con transiciones fluidas, realistas y flexibilidad creativa – impulsado por Seedance 1.5 Pro.

Veo 2

Videos realistas con control de cámara y física avanzada

Preguntas Frecuentes

¿Qué es PixVerse 5.5 Text-to-Video?

Es una página de video basada en texto que requiere prompt. También proporciona controles aspect_ratio, resolution, duration, negative_prompt, style, seed, generate_audio_switch, generate_multi_clip_switch y thinking_type.

¿Qué relaciones de aspecto y resoluciones están disponibles?

aspect_ratio admite exactamente 16:9, 4:3, 1:1, 3:4 y 9:16. resolution admite exactamente 360p, 540p, 720p y 1080p.

¿Qué duraciones de vídeo son compatibles?

duration admite 5, 8 o 10 segundos. Cuando resolution es 1080p, solo se permiten 5 u 8 segundos.

¿El modelo genera audio automáticamente?

No. generate_audio_switch por defecto es false. Configúrelo en true para solicitar música de fondo, efectos de sonido o diálogos; el esquema no garantiza la sincronización de labios ni un formato de audio específico.

¿Cómo funciona la generación de múltiples clips?

generate_multi_clip_switch por defecto es false. Habilítelo para solicitar múltiples clips con cambios dinámicos de cámara. El esquema no establece un recuento de clips ni garantiza la continuidad narrativa.

¿Qué estilos y modos de optimización de prompts están disponibles?

style admite anime, 3d_animation, clay, comic y cyberpunk. thinking_type admite enabled, disabled y auto, con auto como valor predeterminado.

¿Cuánto cuesta PixVerse 5.5 Text-to-Video?

RunComfy gestiona el uso a través de su sistema de crédito actual. Consulte el panel de generación o la documentación de facturación más reciente para conocer el requisito de crédito aplicable; el esquema no garantiza créditos de prueba gratuitos.

¿Esta página acepta una entrada de imagen?

No. Esta es una página de texto a video sin image_url ni campo de imagen de referencia. Utilice el modelo de imagen a vídeo relacionado cuando se requiera un flujo de trabajo basado en imágenes.

¿Cuáles son las principales limitaciones?

La página no tiene dimensiones personalizadas, velocidad de fotogramas, formato de salida, entrada de imagen ni campo de control de cámara dedicado. La salida de diez segundos no está disponible en 1080p, los controles de audio y de múltiples clips están desactivados de forma predeterminada y el esquema no proporciona garantías formales de calidad.

Síguenos
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Soporte
  • Discord
  • Correo electrónico
  • Estado del sistema
  • afiliado
Modelos de Video
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Ver todos los modelos →
Modelos de Imagen
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Ver todos los modelos →
Legal
  • Términos de servicio
  • Política de privacidad
  • Política de cookies
RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.

Ejemplos de PixVerse 5.5 Text to Video

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...