Anima la imagen de un personaje de referencia con el movimiento de un video de conducción mientras mantienes al personaje reconocible.
LTX 2.5 es el modelo de audio y video de peso abierto Lightricks para generar imágenes y sonido sincronizados a partir de texto, imágenes o audio. Esta página ejecuta la herramienta Imagen-to-Video Fast: anime una imagen fija en un clip con audio nativo opcional en un modo centrado en la velocidad creado para borradores rápidos. Las páginas hermanas RunComfy cubren los modos rápidos de texto a video y audio a video en la misma familia LTX 2.5.
Los creadores eligen LTX 2.5 cuando necesitan pesos abiertos además de herramientas Fast alojadas. En todas las tareas, LTX 2.5 mantiene la identidad y el sonido más alineados mientras itera. Muchos equipos comienzan en esta página rápida de imagen a video y luego pasan a otras páginas de tareas LTX 2.5 sin cambiar la dirección creativa.
| LTX 2.5 ventaja | Qué significa para ti |
|---|---|
| Continuidad multidisparo nativa | Escenas conectadas directamente en una sola pasada para que la apariencia, el escenario, la iluminación, la voz y la calificación de los personajes permanezcan alineados en todos los cortes. |
| Detalle adaptativo donde cuenta | El presupuesto de renderizado cambia con la complejidad de la escena, manteniendo las caras, las texturas y el tipo de letra en pantalla más nítidos cuando es necesario. |
| Descodificador de vídeo actualizado | Movimiento más limpio, menos artefactos de reconstrucción y detalles más estables en comparación con generaciones LTX anteriores. |
| Retención de aviso más fuerte | Un codificador de texto Gemma 4 12B más un potenciador de mensajes ayuda a LTX 2.5 a retener instrucciones de varios caracteres, cámara e iluminación. |
| Nivel de iteración rápida | Elige duración auto o duraciones fijas, y escala desde 720p hasta 4K (2160p) con audio incluido en la tarifa. |
LTX 2.5 cubre animaciones fijas, borradores con texto y clips de audio cronometrados en páginas Fast hermanas; esta herramienta se centra en la conversión de imagen a vídeo.
auto o 6–20 s), resolución (720p–2160p), relación de aspecto (auto, 16:9, 9:16), FPS, encendido/apagado de audio y movimiento de cámara opcional.Controles en esta página LTX 2.5 Image-to-Video Fast:
| Parámetro | Requerido | Tipo | Predeterminado | Gama / Opciones | Cómo elegir |
|---|---|---|---|---|---|
image_url* | Sí (*) | URL de la imagen | Ejemplo todavía | JPG, JPEG, PNG, WEBP, GIF, AVIF | Utilice una imagen fija y bien iluminada; La composición bloquea en gran medida el encuadre que LTX 2.5 animará. |
end_image_url | No | URL de la imagen | — | Mismos formatos | Agregue solo para una transformación de inicio → fin; déjelo vacío para movimientos abiertos desde el primer fotograma. |
rápido* | Sí (*) | Cadena | Mensaje de ejemplo | Hasta 5.000 caracteres | Cubre la acción del tema, la cámara, la iluminación, el estilo y las fuentes de audio en un resumen coherente. |
duración | No | Cadena | auto | auto, 6, 8, 10, 12, 14, 16, 18, 20 | Utilice auto para permitir que LTX 2.5 infiera la longitud; elija segundos fijos cuando el tiempo debe coincidir con una edición. |
resolución | No | Cadena | 1080p | 720p, 1080p, 1440p, 2160p | Borrador a 720p; asciende para ubicaciones de héroes y grandes cosechas. |
aspect_ratio | No | Cadena | auto | auto, 16:9, 9:16 | Prefiera auto para seguir la imagen fija; fuerce 16:9 o 9:16 para la entrega de la plataforma. |
fps | No | Entero | 25 | 24, 25, 48, 50 | Haga coincidir la cadencia editorial (24/25) o un movimiento más suave (48/50). |
generate_audio | No | booleano | verdadero | verdadero / falso | Continúe para disfrutar de un ambiente, efectos de sonido o diálogos sincronizados; apagado para placas con imágenes mudas. |
camera_motion | No | Cadena | — | dolly_in, dolly_out, dolly_left, dolly_right, jib_up, jib_down, static, focus_shift | Movimiento de macro opcional cuando desee una ruta de cámara prescrita en la parte superior del mensaje. |
La facturación de LTX 2.5 en esta página es por segundo de video generado. LTX 2.5 Image-to-Video Fast incluye audio nativo en todas las resoluciones.
| Resolución | Precio por segundo | 6s | 10 | 20 años |
|---|---|---|---|---|
| 720p | $0,10 | $0,60 | $1.00 | $2.00 |
| 1080p | $0,14 | $0,84 | $1,40 | $2,80 |
| 1440p | $0,21 | $1,26 | $2.10 | $4.20 |
| 4K (2160p) | $0,33 | $1,98 | $3.30 | $6.60 |
Para lotes, total ≈ duración × tasa por segundo × recuento de salida. Cuando la duración es auto, la facturación de LTX 2.5 sigue la duración real generada.
Estructura reutilizable para LTX 2.5 (mantenga una acción principal por clip):
[quién/qué está en pantalla] + [acción a lo largo del tiempo] + [cámara] + [iluminación y entorno] + [aspecto/calificación] + [fuentes de audio] + [tiempo final]
generate_audio está activado.end_image_url cuando la pose o el diseño final deban aterrizar con precisión.Mensaje débil
> Haga que la foto sea cinematográfica con un agradable movimiento y sonido de la cámara.
Mensaje mejorado para LTX 2.5
> Una mujer con un abrigo de lana gris oscuro se encuentra bajo un paraguas transparente en un paso de peatones resbaladizo por la lluvia en Tokio por la noche. Ella baja el paraguas, camina hacia el paso de peatones mientras un taxi amarillo se desliza por el medio del terreno y los carteles de neón con kanji ondulan sobre el asfalto mojado. Plano amplio y cerrado, finas rayas de lluvia, reflejos suaves. Audio: lluvia ligera, zumbido de tráfico lejano, un neumático blando silbando sobre el agua.
Utilice esta guía familiar LTX 2.5; Los límites exactos dependen del punto final. Basado en información disponible públicamente.
| Modelo | Destacado | Ajuste típico |
|---|---|---|
| LTX 2.5 | Modelo AV de peso abierto con continuidad multidisparo, modos rápidos y resoluciones hasta 4K | Audio y vídeo sincronizados a partir de imágenes fijas, texto o audio con pesos abiertos disponibles |
| LTX 2 | Generación AV Lightricks anterior con niveles Fast/Pro | Tuberías que aún no necesitan actualizaciones de continuidad 2,5 |
| Kling 3.0 | Indicaciones de tomas múltiples con potentes opciones de sincronización de labios | Anuncios de personajes con guión y anuncios guiados por diálogos |
| Semilla 2.0 / 2.5 | Mezcla densa de referencias en imágenes, vídeos y audio | Trabajo de marca que debe trabar la identidad de muchos referentes |
| MiniMax H3 | Familia multimodal con audio estéreo y flujos de trabajo de referencia | Primeros borradores rápidos que luego pueden agregar referencias de estilo Omni |
Elija LTX 2.5 cuando tanto los pesos abiertos como los puntos finales rápidos en la nube sean importantes. Lo que distingue a LTX 2.5 es la continuidad de múltiples tomas con audio nativo en una sola pasada. Ejecute el mismo informe en todos los modelos antes de bloquear una ruta de producción.
Los pesos LTX 2.5 publicados también admiten ajustes locales cuando los borradores alojados no son suficientes.
Anima la imagen de un personaje de referencia con el movimiento de un video de conducción mientras mantienes al personaje reconocible.
Genera voz y audio naturales a partir de texto, audio de referencia o una imagen.
HappyHorse 1.0 Reference to Video fusiona hasta 9 imágenes de referencia y un mensaje en un clip coherente de varios caracteres con identidad estable. Use HappyHorse 1.0 Reference to Video on RunComfy.
Convierte un prompt en un vídeo corto con duración, formato y generación de audio configurables.
Anima una imagen de referencia mediante el movimiento de un vídeo guía.
LTX 2.5 Pro: foto fija a vídeo con audio sincronizado, modo calidad
LTX 2.5 anima una imagen fija a un vídeo corto con audio sincronizado opcional. En esta página, utiliza la herramienta Rápida de imagen a video para borradores rápidos, mientras que las páginas hermanas cubren los modos rápidos de texto a video y audio a video en la misma familia de modelos.
LTX 2.5 puede generar escenas conectadas en una sola pasada para que la apariencia, el entorno, la iluminación, la voz y el estilo visual de los personajes sean más consistentes en todas las tomas. Eso ayuda a las animaciones de campaña y los anuncios de múltiples tiempos que antes necesitaban generaciones separadas de una sola toma.
Puede generar en 720p, 1080p, 1440p o 4K (2160p), con una duración establecida en auto o duraciones fijas de 6 a 20 segundos. Las opciones de FPS incluyen 24, 25, 48 y 50, y la relación de aspecto puede seguir la imagen fija (auto) o usar 16:9 o 9:16.
Sí. Proporcione una imagen inicial (obligatoria) y, opcionalmente, una imagen final cuando desee una transición guiada entre dos composiciones. Deje la imagen final vacía para movimientos abiertos solo desde el primer fotograma.
Se puede generar audio nativo con la imagen cuando generate_audio está habilitado y el audio se incluye en la velocidad por segundo en cada resolución. Desactive el audio si necesita una placa silenciosa para un diseño de sonido posterior.
Las indicaciones pueden tener hasta 5000 caracteres. Las imágenes de inicio y fin opcionales aceptan formatos comunes como JPG, PNG, WEBP, GIF y AVIF. Consulte el panel de parámetros RunComfy actual para conocer los límites de tamaño de carga adicionales.
Sí. Haga un prototipo en la interfaz de usuario web RunComfy, luego llame al mismo modelo rápido de imagen a video LTX 2.5 a través del HTTP API con parámetros coincidentes para los flujos de trabajo de producción y automation.
La facturación es por segundo de video generado: $0,10 en 720p, $0,14 en 1080p, $0,21 en 1440p y $0,33 en 4K (2160p). Cuando la duración es auto, el cargo sigue la duración real generada. Las generaciones consumen USD/créditos el RunComfy; Los nuevos usuarios normalmente reciben una cantidad de prueba gratuita.
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.





