LTX 2.5: anima le foto in 4K video con audio sincronizzato
LTX-2 19B Text-to-Video LoRA è un Diffusion Transformer da 19 miliardi di parametri compatibile con LoRA, progettato per creare brevi video con audio sincronizzato a partire da testo. Elabora prompt e adattatori LoRA facoltativi per produrre clip coerenti in diverse risoluzioni, durate e proporzioni, adatte a contenuti di brand, social media, animazione e prototipazione rapida.
Formato di output: 480p–1080p / durata 5–20 s / proporzioni 16:9 o 9:16 / audio incluso
seed fisso per bloccare i risultati e perfezionare i prompt con aggiornamenti prevedibili.| Parametro | Obbligatorio | Tipo | Predefinito | Intervallo/opzioni | Descrizione |
|---|---|---|---|---|---|
prompt* | Sì (*) | string | — | — | Descrizione della scena, dell’azione e delle indicazioni audio |
resolution | No | enum | 720p | 480p, 720p, 1080p | Risoluzione di output |
aspect_ratio | No | enum | 16:9 | 16:9, 9:16 | Formato di output |
duration | No | number | 5 | 5–20 secondi | Durata del video |
loras | No | list | — | fino a 3 | Adattatori LoRA da applicare |
seed | No | integer | -1 | -1 per un valore casuale | Seed per risultati riproducibili |
L'utilizzo di LTX-2 19B Text-to-Video LoRA viene fatturato per secondo generato in base alla risoluzione.
| Risoluzione | Prezzo al secondo | Unità di fatturazione |
|---|---|---|
| 480p | $ 0,017 | Per secondo generato |
| 720p | $ 0,022 | Per secondo generato |
| 1080p | $ 0,033 | Per secondo generato |
1) Seleziona il modello su RunComfy: Scegli LTX-2 19B Text-to-Video LoRA dal catalogo Modelli.
2) Scrivi il prompt: descrivi il soggetto, le azioni, l'ambientazione, il movimento della telecamera, l'illuminazione e i principali segnali audio (atmosfera, effetti o dialoghi).
3) Aggiungi adattatori (facoltativo): nel campo loras, fai riferimento a un massimo di tre adattatori LoRA per orientare lo stile o l'identità; LTX-2 19B Text-to-Video LoRA li mescolerà durante la generazione.
4) Imposta i controlli di output: scegli la risoluzione (480p/720p/1080p), le proporzioni (16:9 o 9:16) e la durata (5–20 secondi) per corrispondere al canale di destinazione.
5) Riproducibilità: imposta seed su un numero intero fisso per ricreare un risultato o -1 per l'esplorazione con nuove variazioni.
6) Genera: invia il lavoro e visualizza in anteprima la clip con audio sincronizzato; LTX-2 19B Text-to-Video LoRA genera un singolo file video.
7) Rivedi e ripeti: regola il prompt o l'elenco LoRA, modifica la durata/rapporto se l’inquadratura non è adatta ed esegui nuovamente con lo stesso seed per modifiche controllate.
8) API-friendly: utilizza gli endpoint API di RunComfy per automatizzare i lavori batch senza gestire l'infrastruttura o il provisioning della GPU.
seed fisso: blocca un seed per modificare il prompt in piccoli passaggi; questo stabilizza i confronti e rende più facile giudicare le modifiche con LTX-2 19B Text-to-Video LoRA.Se LTX-2 19B Text-to-Video LoRA non è adatto, considera:
LTX 2.5: anima le foto in 4K video con audio sincronizzato
Crea un’immagine da un prompt e controlla LoRA, dimensioni, formato, passaggi, prompt negativo e seed.
HappyHorse 1.0 I2V su Alibaba anima un'immagine fissa in un video nativo a 1080p con movimenti fisicamente accurati e soggetti con identità stabile.
Crea un video con Seedance 1.0 da un prompt e scegli risoluzione, proporzioni e durata.
Animazioni AI di alta qualità, controllo in tempo reale e effetti pro
Anima un’immagine iniziale tramite testo e configura formato, risoluzione, durata, stile, audio e clip multiple.
LTX-2 19B Text-to-Video LoRA supporta, a livello di modello, fino al 4K nativo (3840×2160) a 50 fps. In questo flusso sono disponibili 480p, 720p e 1080p, con proporzioni 16:9 o 9:16. Ogni prompt può contenere attualmente circa 512 token.
È possibile caricare fino a tre moduli LoRA alla volta, inclusi IC-LoRA per controllare posa, profondità o bordi e migliorare la coerenza strutturale della composizione.
Perfeziona prima prompt e impostazioni nel browser. Quando il flusso è pronto, usa l’API RunComfy per automatizzare generazione, caricamento degli adattatori e post-produzione. Si applica lo stesso sistema di crediti in USD della pagina del modello.
È particolarmente adatto a clip di marketing, video didattici, dialoghi di personaggi animati e brevi contenuti stilizzati in cui servono frequenza dei fotogrammi elevata e audio sincronizzato. I LoRA configurabili aiutano anche a mantenere coerente lo stile del brand.
Il backbone Diffusion Transformer (DiT) modella insieme i fotogrammi e la forma d’onda audio. In questo modo genera in un unico passaggio tempi dei dialoghi, sincronizzazione labiale e suoni ambientali, senza sintesi audio separata.
Sì. I flussi leggeri di addestramento LoRA consentono di adattare stile, movimento o personaggi e integrare gli adattatori nella pipeline principale. Puoi addestrare i tuoi LoRA con RunComfy Trainer.
RunComfy è la piattaforma principale ComfyUI che offre ComfyUI online ambiente e servizi, insieme a workflow di ComfyUI con visuali mozzafiato. RunComfy offre anche AI Models, consentire agli artisti di sfruttare gli ultimi strumenti di AI per creare arte incredibile.





