ComfyUI>Flujos de trabajo>LTX 2.5 ComfyUI Texto a Video | Multishot Nativo y 4K HDR

LTX 2.5 ComfyUI Texto a Video | Multishot Nativo y 4K HDR

Workflow Name: RunComfy/LTX-2.5-ComfyUI-T2V
Workflow ID: 0000...1490
Convierte tus indicaciones en clips cinematográficos cortos con la generación de texto a video LTX-2.5. Obtienes audio sincronizado y movimiento fluido. Mejora automáticamente las indicaciones. Escala detalles latentes para obtener cuadros más nítidos. Prototipa escenas, tomas de productos y momentos de personajes. Ejecútalo rápidamente en RunComfy.

LTX 2.5 ComfyUI Text to Video Workflow

LTX 2.5 ComfyUI Text to Video | Upscaling + Synced Audio
Want to run this workflow?
  • Fully operational workflows
  • No missing nodes or models
  • No manual setups required
  • Features stunning visuals

LTX 2.5 ComfyUI Text to Video Examples

LTX 2.5 ComfyUI Texto a Video: De indicación a video con audio sincronizado#

LTX 2.5 ComfyUI Texto a Video es un flujo de trabajo listo para RunComfy que convierte una breve indicación escrita en un video cinematográfico con una pista de audio alineada. Combina el transformador destilado LTX-2.5 de Lightricks para la generación de texto a video, VAEs compactos de video/audio para la reconstrucción, un escalador latente para detalles más nítidos y una mejora de indicaciones basada en Gemma para una mayor adherencia a la indicación.

Diseñado para creadores que desean iteraciones rápidas y locales dentro de ComfyUI, este gráfico sobresale en escenas atmosféricas, tomas de productos, momentos de personajes y piezas de ambiente. Con LTX 2.5 ComfyUI Texto a Video, puedes pasar de la idea a la vista previa en minutos, luego refinar el movimiento, la apariencia y el tiempo sin salir de RunComfy.

Modelos clave en el flujo de trabajo de Comfyui LTX 2.5 ComfyUI Texto a Video#

  • Lightricks LTX-2.5. El núcleo del transformador destilado que sintetiza video temporalmente coherente a partir de texto. Equilibra la fidelidad a la indicación y el realismo del movimiento mientras mantiene la inferencia rápida. Vea la tarjeta de modelo oficial en Lightricks/LTX-2.5 y la canalización de referencia en Lightricks/LTX-2.5-Diffusers.
  • Google Gemma 2 Instruct. Un modelo de lenguaje compacto sintonizado por instrucciones que se utiliza para expandir y clarificar las indicaciones del usuario antes de la generación, mejorando la guía de estilo y la intención de la toma. Un punto de control representativo es google/gemma-2-9b-it.
  • Centro de organización de Lightricks. Listado central para lanzamientos y actualizaciones de LTX a la familia de texto a video, útil para notas de modelos y comportamientos conocidos: huggingface.co/Lightricks.

Cómo utilizar el flujo de trabajo de Comfyui LTX 2.5 ComfyUI Texto a Video#

Este flujo de trabajo sigue un camino limpio desde la indicación al video: mejora de la indicación, acondicionamiento de texto, síntesis de video latente, escalado, decodificación, alineación de audio y exportación. Las secciones a continuación explican cada etapa en lenguaje sencillo para que sepas qué cambiar y por qué.

Indicaciones y preajustes#

Comienza escribiendo una indicación concisa que indique el sujeto, el entorno, la iluminación, la sensación de la lente o cámara, y la intención del movimiento. Opcionalmente, agrega una indicación negativa para alejarte de elementos no deseados. Elige un preajuste de estilo si se proporciona para configurar rápidamente las tendencias de color y contraste. Si el gráfico expone el control de semilla, mantén la semilla estable mientras iteras la redacción para que las diferencias reflejen tus ediciones, no la aleatoriedad. LTX 2.5 ComfyUI Texto a Video se beneficia de verbos de movimiento explícitos como "lento acercamiento en dolly," "cámara en mano," o "brisa sutil."

Acondicionamiento de texto#

Tu indicación se tokeniza y codifica, luego se reescribe ligeramente por Gemma para fortalecer la intención y eliminar la ambigüedad. El texto mejorado crea vectores de acondicionamiento que el modelo de video utiliza para decidir el diseño, la apariencia del sujeto y las señales de movimiento. Mantén las descripciones concretas y visuales; evita listas largas de modificadores que compitan entre sí. Si necesitas identidad o marca consistentes, coloca esos términos al principio de la indicación. Este paso es donde LTX 2.5 ComfyUI Texto a Video se enfoca en el significado antes de que se genere cualquier píxel.

Síntesis de video latente#

El flujo de trabajo inicializa una línea de tiempo latente dimensionada a la relación de aspecto y duración elegidas. LTX-2.5 desruida iterativamente este video latente, tejiendo estructura, movimiento y apariencia en cada cuadro mientras mantiene la coherencia temporal. Las tomas más cortas convergen más rápido y son más fáciles de dirigir; extiende la duración solo después de que te guste el primer golpe. Usa indicaciones negativas para suprimir artefactos como extremidades adicionales, parpadeo o superposiciones de texto. El objetivo aquí es un clip latente limpio y enfocado que ya se lea como tu escena prevista.

Movimiento y tiempo#

Durante la desruida, el modelo equilibra el detalle espacial con el movimiento suave. Las señales de movimiento fuertes en tu indicación ayudan a evitar clips que parezcan estáticos; demasiadas demandas de textura de grano fino pueden reducir la claridad del movimiento. Si el gráfico incluye un control de fuerza del movimiento, aumentalo para tomas dinámicas y redúcelo para retratos o ángulos de productos macro. Al probar variaciones, cambia un elemento a la vez para que puedas atribuir diferencias a una edición específica. LTX 2.5 ComfyUI Texto a Video generalmente recompensa los verbos de cámara claros y un enfoque en un solo sujeto.

Escalado latente#

Un escalador latente dedicado refina el detalle sin romper la estabilidad temporal. Habilita este paso una vez que el movimiento base y la composición se vean bien. Si los reflejos brillan o los bordes se sobresaturan, reduce ligeramente la fuerza y vuelve a ejecutar; si la imagen se siente suave, aumentala. Escalar después de que el movimiento se estabilice preserva mejor la coherencia que comenzar con una resolución base más alta. Esta etapa le da a LTX 2.5 ComfyUI Texto a Video su nitidez sin introducir destellos.

Decodificación y color#

El VAE de video decodifica latentes en cuadros, aplicando el espacio de color y el mapeo de tonos adecuado para la vista previa y exportación. Si está disponible, elige un perfil de apariencia que coincida con tu intención: neutral para calificar más tarde, cinematográfico para diarios listos para compartir. El banding menor o el parpadeo a menudo indican un enfoque demasiado agresivo en el escalador; ajusta la fuerza del escalador en lugar de forzar un contraste posterior más pesado. Mantén la relación de aspecto consistente en todas las ejecuciones para comparar resultados de manera justa. La decodificación es donde tus cuadros se convierten en píxeles que puedes evaluar.

Generación y sincronización de audio#

Un módulo de audio genera una banda sonora ligera a partir de la misma indicación y la alinea con la línea de tiempo del video. Usa palabras de ambiente como "dron inquietante," "sintetizador optimista," o "lluvia suave" para dirigir la cama. Si el flujo de trabajo expone un interruptor de audio, puedes deshabilitarlo mientras exploras el movimiento, luego habilitarlo para las versiones finales. Pequeños ajustes en la indicación pueden cambiar el ritmo y la intensidad; bloquea tu semilla visual al audicionar variaciones de audio. El objetivo es un audio cohesivo que apoye la escena sin competir con ella.

Exportación y revisión#

Elige tu contenedor y preajuste de códec para una vista previa compacta o un archivo compartible de mayor calidad. Si el gráfico incluye una exportación de cuadros, puedes inspeccionar cuadros individuales en busca de artefactos antes de comprometerte a una ejecución completa. Mantén un registro de la indicación, semilla y cualquier interruptor para que puedas reproducir o ramificar ideas. Para revisión social o de productos, usa el preajuste de vista previa; para carretes o presentaciones a clientes, usa el preajuste de alta calidad. LTX 2.5 ComfyUI Texto a Video está optimizado para que puedas iterar rápidamente, luego escalar y exportar cuando estés listo.

Extras opcionales#

  • Escribe indicaciones en lenguaje de toma: sujeto + entorno + iluminación + lente + movimiento (por ejemplo, "héroe de producto sobre mármol, luz de fondo suave, 50 mm, arco lento a la izquierda").
  • Prefiere una señal de estilo decisiva sobre muchas débiles. Demasiados adjetivos diluyen la guía.
  • Usa indicaciones negativas para suprimir superposiciones de texto, grano excesivo o formas similares a logotipos cuando no se deseen.
  • Bloquea la semilla para comparar ediciones de indicaciones; cambia la semilla para explorar composiciones frescas.
  • Comienza corto, luego extiende la duración una vez que el movimiento se lea claramente; los clips más largos agravan pequeños problemas.
  • Si las caras son centrales, mantén el movimiento de la cámara suave y la iluminación estable para reducir el desplazamiento temporal.
  • Para exportaciones limpias, evita el redimensionamiento en postproducción; establece el aspecto y la resolución en el gráfico y mantenlos consistentes.

Este flujo de trabajo de LTX 2.5 ComfyUI Texto a Video está diseñado para ayudarte a obtener movimiento convincente, detalle nítido y audio alineado con una configuración mínima. Itera rápidamente, guía con intención clara y deja que el gráfico maneje el trabajo pesado de texto a video.

Agradecimientos#

Este flujo de trabajo implementa y se basa en los siguientes trabajos y recursos. Agradecemos con gratitud a Comfy.org por la plantilla de flujo de trabajo fuente, a Lightricks por los pesos del modelo LTX-2.5, y a Lightricks por el proyecto LTX-2.5 Diffusers por sus contribuciones y mantenimiento. Para detalles autorizados, consulte la documentación original y los repositorios enlazados a continuación.

Recursos#

Nota: El uso de los modelos, conjuntos de datos y código referenciados está sujeto a las licencias y términos respectivos proporcionados por sus autores y mantenedores.

RunComfy
Derechos de autor 2026 RunComfy. Todos los derechos reservados.

RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.