Pesos abiertos de referencia a video a partir de señales de imagen, video y audio.
Category
Peso abierto de imagen a vídeo con último fotograma opcional y audio estéreo nativo.
Texto a vídeo de peso abierto con 480p/768p y audio estéreo nativo.
FLUX 3 Draft Extend: Borradores de continuación de clips rápidos y de bajo costo en 720p
FLUX 3 Draft Keyframes: vistas previas rápidas de vídeo con múltiples fotogramas clave a 720p
FLUX 3 Draft FLF: vistas previas rápidas de vídeo de fotogramas de inicio y fin a 720p
FLUX 3 Draft I2V: Vista previa rápida de borradores de fotografías a vídeo a 720p
Wan 2.6 Image-to-Image: IA basada en instrucciones para edición visual fluida y adaptación de estilo escalable
Transforma tus imágenes con Seedream 4.5 Edit edición de imágenes para crear visuales coherentes, fotorrealistas y con consistencia de marca precisa.
Edición guiada por referencias con control de composición, separación de capas y texto multilingüe
Convierte imágenes estáticas en clips fluidos con control de audio.
Convierte imágenes en videos realistas con audio y movimiento fluido
Borrador de FLUX 3: vistas previas rápidas y económicas de texto a vídeo a 720p
Seedance 2.5 FLF2V 480p: Transiciones del primer borrador del último cuadro a menor costo
Seedance 2.5 Referencia 480p: Vídeo borrador multireferencia a menor coste
Seedance 2.5 480p: Borradores de animación de foto fija a video rápidos y de bajo costo
Seedance 2.5 480p: borradores de texto a video rápidos y de bajo costo a partir de indicaciones
Alargue los clips existentes más allá del fotograma final con un movimiento coherente con la escena.
Genere vídeo a partir de fotografías de varios fotogramas clave con audio opcional
Genere video entre los fotogramas inicial y final con audio opcional
Anima una imagen inicial a vídeo con audio nativo opcional
Seedance 2.5 First & Last Frame: conecta la imagen inicial y final en un vídeo cinematográfico fluido
Flux 2 Flash Edit edita hasta cuatro imágenes de referencia mediante instrucciones claras y ofrece controles precisos de tamaño y formato de salida.
Convierte bocetos en visuales precisos de 2K-4K con Nano Banana Pro, corrección inteligente y control creativo fluido.
Edite o combine de 1 a 10 imágenes JPEG o PNG requeridas con el prompt obligatorio. Elija `1K`, `2K`, `4K` o uno de los ocho ajustes preestablecidos de resolución fija.
Crea escenas de vídeo realistas a partir de imágenes fijas con movimiento, sincronización de diálogos y control creativo flexible.
WAN 2.7 image edit permite editar mediante texto con 1–4 imágenes de referencia, ampliación opcional del prompt, instrucciones bilingües y tamaños de salida predefinidos.
Genera visuales de marca con texto y logotipos integrados precisos.
Modelo de edición con LoRA para transformar recursos visuales con precisión y conservar su estructura.
Edición de imagen GPT Image 2 de OpenAI: ediciones de imagen a imagen con control de texto preciso y pintura de entrada y salida
Edición de imágenes guiada por prompts con Nano Banana 2 Edit, con entrada de múltiples imágenes y controles de relación de aspecto, resolución, tolerancia de seguridad y salida.
Convierte imágenes de referencia en un video fluido en 720P o 1080P con un solo prompt.
Genere videos de 4 a 12 segundos a partir de texto en 480p, 720p o 1080p, con seis relaciones de aspecto más audio y controles de cámara fija.
Convierte imágenes estáticas en videos reales con velocidad y detalle profesional.
Seedance 2.5: anima una imagen fija a vídeo cinematográfico con IA
Seedance 2.5 Reference to Video: crea vídeos cinematográficos con IA a partir de referencias
Genere un vídeo de 5, 10 o 15 segundos a partir de un mensaje de texto, con audio de origen opcional y controles de tamaño, estructura de toma, mensaje negativo, semilla, expansión del mensaje y audio generado.
MiniMax H3: texto a vídeo 768p/2K con audio estéreo nativo
Genere una imagen a partir de un prompt requerido utilizando uno de los seis ajustes preestablecidos de tamaño exacto y una semilla entera opcional; el valor de semilla predeterminado -1 selecciona una semilla aleatoria.
Genere vídeo de 768p o 2K a partir de referencias de imagen, vídeo y audio
Edite hasta 10 imágenes de origen mediante instrucciones de texto y elija entre siete tamaños de salida y formato JPEG o PNG.
Visuales precisos con IA, control en tiempo real y efectos pro
Crea imágenes 4K precisas con herramientas flexibles de fusión y texto
Conversión de texto a imagen en 4 pasos de alta fidelidad con representación de texto nítida
Animación de imágenes con calidad Pro: clips cinematográficos de 3 a 15 segundos desde 0,112 $ por segundo.
Edita o combina entre 1 y 10 imágenes con un prompt y elige relación de aspecto, formato y número de resultados.
Flux 2 Turbo Edit edita hasta cuatro imágenes de referencia mediante instrucciones claras y ofrece controles precisos de tamaño y formato de salida.
Convierte imágenes estáticas en contenido de video sincronizado con movimiento y alta definición con control flexible usando Wan 2.6.
Modelo de video con IA multimodal y audio nativo para generación desde texto, imágenes y referencias.
Genera una imagen únicamente desde un prompt y elige entre 2K, 4K y nueve tamaños fijos.
Generación y edición de imágenes con control de composición y capas
Crea clips cinematográficos 2K con sincronización labial precisa y control de cámara.
HappyHorse 1.0 Video Edit en Alibaba edita un video de entrada con instrucciones de texto e imágenes de referencia para transferencia de estilo, reemplazo local e intercambios de vestimenta.
Genera entre 1 y 4 imágenes desde un prompt y elige relación de aspecto, resolución, formato y modo de devolución.
Anima una foto y crea un video fluido en 720P o 1080P con un solo prompt.
Cree un vídeo a partir de un mensaje de texto y de uno a tres clips de referencia, con controles de duración, tamaño de salida, estructura de la toma, semilla, mensaje negativo y generación de audio.
Transforma imágenes estáticas en clips de video cinematográficos con transiciones fluidas, realistas y flexibilidad creativa – impulsado por Seedance 1.5 Pro.
Genera de una a cuatro imágenes desde un prompt y elige relación de aspecto, pasos, semilla y formato.
Clips Image-to-Video de 3 a 15 segundos por $0.084 por segundo.
Generación rápida y de alta calidad de texto a imagen con Nano Banana 2, con controles de relación de aspecto, tolerancia de seguridad y formato de salida.
Anima una imagen del primer fotograma a un vídeo de 768p o 2K durante hasta 15 segundos
Edita o transforma hasta 20 imágenes de referencia con un prompt y elige cantidad, formato, relación de aspecto y resolución.
Convierte imágenes en videos realistas con fluidez y estilo profesional
Crea animaciones realistas a partir de imágenes con estilo cinematográfico.
Imágenes detalladas y texto preciso para creadores visuales
Edita entre 1 y 14 imágenes de referencia mediante texto y configura una secuencia de hasta 15 salidas.
Edición de imágenes rápida, económica y guiada por prompts con resolución fija de 1K.
Crea clips en 1080p con varias referencias y control de fotogramas.
Transforma referencias visuales o de audio en clips HD con control preciso del movimiento.
Genere imágenes de diseño precisas con control refinado y detalles repetibles.
Genera carteles, logotipos e imágenes donde la tipografía es protagonista a partir de prompts de texto.
Seedream 5.0 Lite Texto a Imagen: motor de prompts a visuales con control preciso de composición y tipografía
Seedance 2.5, muy pronto: vídeos cinematográficos con IA, mayor coherencia y clips más largos
Convierte texto en imágenes únicas, edita y personaliza con facilidad
Herramienta avanzada de edición de imagen a imagen que respeta la geometría y mantiene la identidad del sujeto en flujos creativos.
FLUX 3 Image es un modelo de imagen multimodal con guía por referencias y texto legible
Crea películas de múltiples escenas con diálogos sincronizados y personajes consistentes. Use Kling 3.0 on RunComfy.
Anima una imagen inicial y crea un clip cinematográfico con audio nativo.
Modelo de movimiento cinematográfico para creación fluida de escenas y edición visual adaptativa.
Edición visual con IA que combina texto bilingüe y control exacto.
Crea imágenes realistas a partir de prompts, con tipografía precisa en chino e inglés y composiciones equilibradas.
Crea con Wan 2.2 Plus un vídeo de cinco segundos desde un prompt y elige tamaño, seed y ampliación del prompt.
WAN 2.7 Pro image edit ofrece ediciones de alta fidelidad mediante prompts con 1–4 referencias, ampliación del prompt y los mismos controles que la versión Standard.
Genere imágenes a partir de prompts de texto con seis tamaños predefinidos, control de semilla y salida JPEG o PNG.
Edite hasta tres imágenes de origen y ajuste la intensidad del prompt, los pasos de inferencia, la cantidad, la expansión del prompt, el tamaño, la semilla y el formato.
Genera videos realistas a partir de imágenes con audio natural y fluidez excepcional.
Edite una imagen requerida a partir de una instrucción de texto requerida con FLUX Kontext Pro, una semilla y nueve opciones de relación de aspecto.
Prompt-driven Pro-tier video editing at $0.168 per second.
Convierte imágenes en videos 1080p fluidos con realismo sorprendente
Transformación de metraje mediante IA con movimiento estable y control creativo.
Convierta una imagen de referencia en un vídeo de 5 o 10 segundos, con un prompt negativo opcional y generación de audio nativo.
Anima una imagen inicial mediante un prompt y controla LoRA, fotogramas, FPS, resolución, relación de aspecto, pasos y seed.
Seedream 5.0 Lite transforma visuales de referencia en diseños con layout preciso y estilo consistente para flujos creativos.
Cree imágenes refinadas a partir de texto con detalles precisos y control de estilo flexible para flujos de trabajo de diseño.
Anima una imagen con un prompt para crear un vídeo de 5 u 8 segundos en 480p o 720p.
Genera canciones con voces de hasta 4 minutos a partir de etiquetas de estilo y letras.
Convierte imágenes en videos cinematográficos al instante con Veo 3.1 Fast.
Genere un video de 5 o 10 segundos a partir de un prompt obligatorio. Opcionalmente, agregue una pista de audio WAV o MP3, un prompt negativo y uno de los 13 tamaños de salida.
Crea secuencias visuales coherentes con control preciso de estilo y continuidad.
Image-to-video prémium con la mayor fidelidad visual y el movimiento más realista de la familia Kling V3.0.
Cree una imagen a partir de un prompt y hasta siete imágenes de referencia, con relación de aspecto seleccionable, resolución 1080p–4K y control de semilla.
Escala un vídeo fuente a la resolución y la frecuencia de fotogramas elegidas.
Genera voz y audio naturales a partir de texto, audio de referencia o una imagen.
Crea un vídeo animado a partir de una imagen de referencia y un vídeo fuente; permite elegir tamaño de salida y seed.
Convierte tus imágenes en videos HD con movimientos realistas y rápidos
Genera imágenes desde texto y combina hasta tres adaptadores LoRA con pesos independientes.
Edita una imagen con FLUX Kontext Max mediante un prompt, define la semilla y elige una de 9 relaciones de aspecto.
Convierta imágenes fijas en clips de movimiento cinematográficos con cámara y control de audio.
Crea un vídeo corto con audio sincronizado a partir de imágenes de referencia y una instrucción.
Convierte ideas escritas en imágenes coherentes con tu marca mediante un control preciso del estilo.
Edite de una a diez imágenes de referencia a partir de una instrucción de texto con ajustes preestablecidos de tamaño seleccionables, semillas y salida JPEG o PNG.
Edita un vídeo fuente mediante una instrucción de texto sin perder la coherencia de la escena.
Convierta un retrato y una pista de audio en un vídeo de avatar parlante, con un prompt opcional de movimiento o forma de hablar.
Anima una imagen inicial con Hailuo 02 Pro mediante un prompt para crear un vídeo de seis segundos.
Convierte imágenes en videos con realismo y control artístico para diseñadores.
Convierte imágenes en videos fluidos con precisión y transiciones naturales
Genere un vídeo a partir de una imagen de retrato requerida y una pista de audio requerida de menos de 35 segundos. Agregue orientación opcional en seis idiomas admitidos y utilice el control inicial, cuyo valor predeterminado es -1.
Generación de vídeo con calidad cinematográfica al nivel de Seedance 2.0, gran fidelidad visual y movimiento natural
HappyHorse 1.0 I2V en Alibaba anima una imagen fija en video nativo de 1080p con movimiento con precisión física y sujetos con identidad estable.
Genere una nueva imagen a partir de un mensaje de texto con seis ajustes preestablecidos de tamaño fijo, control de semillas y salida JPEG o PNG.
Genera entre una y diez imágenes por solicitud a partir de un prompt de texto.
Redefine el estilo cuadro a cuadro y mantiene coherencia visual en tus videos.
Conversión de texto a imagen en menos de un segundo en 4 pasos con imágenes precisas
Transforme una imagen de entrada con indicación, intensidad, tamaño, 1 a 8 pasos de inferencia, semilla, expansión de indicación y salida JPEG, PNG o WebP.
Amplía una pista de audio al principio, al final o en ambos extremos manteniendo su estilo.
Edite o transforme imágenes a partir de una instrucción de texto utilizando de una a diez imágenes de referencia y controles explícitos de tamaño, fondo, calidad, fidelidad de entrada y formato de salida.
Genera clips cinematográficos con mayor rapidez mediante referencias multimodales, sincronización labial y control de cámara.
Convierte imágenes en videos realistas 2K con movimiento fluido y gran detalle.
Genere un video con audio sincronizado a partir de un prompt de texto obligatorio. Elija `1280x720` o `720x1280` y una duración de `4`, `8` o `12` segundos.
FLUX 3 Video convierte indicaciones de texto en clips cinematográficos con audio nativo
WAN 2.7 texto a imagen: gran comprensión de prompts, tamaños flexibles y hasta cinco imágenes por solicitud
Convierte imágenes en videos con movimiento y realismo cinematográfico.
Edita detalles de la piel en una sola imagen y controla tamaño, pasos, guía, variantes, formato y seed.
Convierta retratos fijos en vídeos expresivos y realistas con control y precisión.
Edita de una a diez imágenes mediante un prompt y controla tamaño, ampliación, guía, pasos, semilla y formato.
Genere un vídeo 16:9 a partir de una imagen y un prompt, con duración, resolución, frecuencia de fotogramas y audio opcional.
Edite de una a tres imágenes de origen requeridas con una instrucción requerida de menos de 800 caracteres. Solicite de 1 a 6 resultados, agregue un mensaje negativo de menos de 500 caracteres y establezca una semilla de 0 a 2147483647.
Generación rápida y económica de imágenes a partir de texto, con resolución fija de 1K.
Anime una imagen requerida con un prompt obligatorio usando Kling 2.1 Standard, con controles de duración, relación de aspecto, prompt negativo y intensidad del prompt.
Convierta un retrato y un vídeo de referencia en una animación expresiva guiada por un prompt de texto requerido.
Genera de 1 a 4 imágenes a partir de un prompt obligatorio, con 10 relaciones de aspecto, resolución 1K, 2K o 4K, tres formatos de archivo y retorno síncrono opcional.
WAN 2.7 Pro text-to-image genera imágenes fijas de alta fidelidad para impresión y gran formato. Conserva los mismos controles del modelo Standard, admite prompts bilingües y produce hasta cinco imágenes por ejecución.
Convierte retratos en videos realistas con sincronización precisa de voz
Combina o edita de 1 a 10 imágenes de origen a partir de un prompt obligatorio. Puedes configurar seis tamaños de salida, los pasos de inferencia, la escala de guía, entre 1 y 4 resultados, la semilla y la salida JPEG o PNG.
Convierte imágenes en videos 1080p realistas con control creativo y fluidez total.
Convierte imágenes fijas en videos realistas y dinámicos en 2K.
Transforma un clip de origen mediante un prompt de texto y audio nativo.
Anima la imagen de un personaje de referencia con el movimiento de un video de conducción mientras mantienes al personaje reconocible.
Convierte texto en imágenes realistas con alta velocidad y detalle
Crea imágenes asombrosas desde texto con IA avanzada y edición precisa.
Inpainting preciso guiado por máscara para retoque fotográfico, edición de objetos y reconstrucción de escenas.
Anime una imagen de origen obligatoria mediante un prompt. Elija 6, 8 o 10 segundos, de 1080p a 2160p, 25 o 50 FPS, formato 16:9 fijo y audio generado opcional.
Genere imágenes basadas en texto con seis modos de estilo y once relaciones de aspecto.
Crea videos 1080p desde texto con IA realista, capturando movimiento y emoción con precisión artística.
Edite entre 1 y 10 imágenes de origen con un prompt obligatorio y aplique, si lo necesita, hasta tres entradas LoRA. Elija entre seis tamaños de salida y configure los pasos de inferencia, la escala de guía, de 1 a 4 resultados, la semilla y salida Default, JPEG o PNG.
Generación cinematográfica de imagen a vídeo 4K a 0,42 $ por segundo de salida.
Convierte imágenes en videos realistas con audio y escenas sincronizadas
Transforma imágenes en videos cinematográficos al instante con la potencia creativa de Veo 3.1 Fast.
Convierte imágenes y textos en videos HD con movimiento realista.
Crea un vídeo desde un prompt y controla LoRA, resolución, relación de aspecto, fotogramas, FPS, pasos y seed.
Anima una imagen de origen obligatoria con uno de 48 efectos predefinidos y controles de resolución, duración, prompt negativo y optimización.
Anime una imagen de inicio requerida con un prompt obligatorio usando Kling 2.1 Pro, con una imagen final, duración, relación de aspecto, prompt negativo e intensidad del prompt opcionales.
Crea imágenes 4K precisas con IA y controla el estilo para máximo diseño.
Cree un vídeo de seis o diez segundos a partir de un prompt de texto requerido con Hailuo 02 y una expansión del prompt opcional.
Genera un vídeo a partir de una imagen, un audio y un prompt, con control independiente del texto y el audio.
Edita un segmento preciso de una pista de audio sin alterar el resto.
Generación cinematográfica de texto a vídeo con calidad Pro a 0,112 $ por segundo de salida.
Crea una imagen con Wan 2.2 Plus desde un prompt y elige tamaño, seed y ampliación del prompt.
Movimiento realista, cámara dinámica y control preciso del estilo.
Convierte un prompt en un vídeo corto con duración, formato y generación de audio configurables.
Genere una imagen a partir de un prompt obligatorio de menos de 2000 caracteres. Agregue un prompt negativo opcional y elija entre 13 tamaños de salida.
Transforma imágenes en videos realistas con movimiento fluido y gran calidad.
Transforma imágenes en videos fluidos con escenas naturales y movimiento coherente.
Cree un video sincronizado con los labios a partir de las URL de audio y video requeridas, con cinco modos para manejar duraciones de entrada que no coinciden.
Edite hasta tres imágenes con un máximo de tres LoRA y controles precisos de escala de guía, pasos de inferencia, tamaño, semilla y formato de salida.
Generación de vídeo de nivel Pro guiada por referencias: clips de 3 a 15 segundos desde 0,112 $ por segundo.
Dirija un video de fuente corta con una pista de audio requerida, luego controle la emoción, edite el alcance, el comportamiento de no coincidencia de duración y la expresividad.
Convierte imágenes en videos naturales con transiciones precisas
Cree una edición de la escena siguiente a partir de un prompt obligatorio y exactamente una imagen de origen. Elija entre seis tamaños de salida y configure entre 2 y 50 pasos de inferencia, una escala de guía de 0 a 20 (valor predeterminado: 6), de 1 a 4 resultados, la semilla y salida JPEG o PNG.
Edita una imagen de origen mediante un prompt obligatorio, con máscara opcional, de 2 a 50 pasos de inferencia, resolución 480p o 720p, control de semilla y tres formatos de salida.
Edite una imagen de referencia requerida desde un mensaje requerido. Solicite de 1 a 4 resultados en PNG, JPEG o WebP y, opcionalmente, devuelva medios como un URI de datos con `sync_mode`.
Herramienta de conversión de movimiento impulsada por IA que permite la creación de animaciones precisas y estables
Modelo de video con IA rápido y económico para crear clips de varias tomas con audio nativo y referencias.
Genera imágenes desde texto y controla tamaño, ampliación del prompt, guía, pasos, semilla y formato.
Genera un vídeo a partir de una pista de audio y una imagen, con prompt y semilla opcionales.
Inpainting rápido y preciso con personalización LoRA opcional para imágenes de producto y creativas.
Edita una imagen obligatoria mediante una instrucción de texto obligatoria, con expansión del prompt, dos resoluciones, semilla y formatos de salida.
Amplía un vídeo existente 7 segundos a 720p con control mediante prompt y audio generado opcional.
Aplica cambios mediante un prompt dentro de una escena y controla tamaño, pasos, guía, variantes, formato y seed.
Crea canciones mediante prompts, con salida WAV de 44,1 kHz y edición por secciones.
Edita imágenes con texto y mantén estilo y coherencia visual
HappyHorse 1.0 con salida nativa 1080p, movimiento cinematográfico y coherencia multi-plano.
Anima una imagen fija y conviértela en un vídeo corto con audio sincronizado.
Elimina fondos con la variante Fast y configura códec, refinado de bordes y tipo de sujeto.
Transforma imágenes en capas RGBA editables para un aislamiento preciso de objetos y un control perfecto del diseño.
Crea secuencias visuales coherentes a partir de texto con IA avanzada.
Genere un vídeo a partir de un prompt obligatorio con 6, 8 o 10 segundos, de 1080p a 2160p, 25 o 50 FPS, formato 16:9 fijo y audio generado opcional.
Convierte imágenes en videos realistas con efectos cinematográficos.
Generación cinematográfica 4K a partir de referencias, a 0,42 $ por segundo de salida.
Cambia el ángulo de cámara de una imagen de origen o aplica otra edición mediante un prompt obligatorio. Puedes configurar seis tamaños de salida, los pasos de inferencia, la escala de guía, entre 1 y 4 resultados y la salida JPEG o PNG.
Anima una imagen inicial mediante texto y configura formato, resolución, duración, estilo, audio y varios clips.
HappyHorse 1.0 Reference to Video fusiona hasta 9 imágenes de referencia y un mensaje en un clip coherente de varios caracteres con identidad estable. Use HappyHorse 1.0 Reference to Video on RunComfy.
Convierte imágenes en videos fluidos y cinematográficos con IA
Genere un vídeo a partir de las imágenes de referencia y los elementos obligatorios. Use tokens @Image y @Element en el mismo orden de los arrays y defina con precisión la duración y la relación de aspecto.
Convierte texto en videos creativos en segundos con IA avanzada.
Crea un vídeo con Kling 2.5 Turbo desde un prompt y elige duración, relación de aspecto y prompt negativo.
Separa personas u objetos del fondo del vídeo y configura códec, refinado de bordes y tipo de sujeto.
Crea un vídeo con Seedance 1.0 desde un prompt y elige resolución, relación de aspecto y duración.
Convierte imágenes en videos realistas con la precisión y fluidez de la IA de Veo 3.1.
Edite una imagen de origen con un prompt de texto y controles para los pasos de inferencia, la fuerza para seguir las instrucciones del texto, la semilla y la salida JPEG, PNG o WebP.
Convierte imágenes en clips cinematográficos rápidos y realistas
Genera imágenes precisas y creativas a partir de texto con IA avanzada.
Anima una imagen de referencia con Sora 2 Pro mediante un prompt y elige el tamaño y la duración.
Edite un video existente con una instrucción de texto y hasta diez imágenes de referencia opcionales, con un control para preservar el audio original.
Amplía un vídeo existente 7 segundos a 720p con control mediante prompt y audio generado opcional.
Crea un vídeo con Wan 2.1 a partir de un prompt de texto y configura resolución, relación de aspecto, fotogramas, frecuencia y otras opciones.
Crea videos realistas con personajes y estilos coherentes fácilmente
Crea una imagen desde un prompt y controla LoRA, tamaño, formato, pasos, prompt negativo y seed.
Amplía una imagen de entrada obligatoria y controla los pasos de inferencia, la intensidad de LoRA, la semilla y el formato de salida.
Elimina el fondo de un vídeo y ajusta el códec y la supresión del derrame de color para la edición posterior.
Restaure y mejore un video requerido. Controle el ancho de salida, el límite de cuadros, la velocidad de fotogramas, la semilla, la guía de restauración y el tamaño del lote.
Sincroniza una pista de audio con un vídeo y decide si el vídeo debe repetirse.
Sincroniza una pista de audio con un vídeo existente mediante dos URL obligatorias.
Vuelve a iluminar o edita una imagen de origen a partir de un prompt obligatorio. Puedes configurar seis tamaños de salida, los pasos de inferencia, la escala de guía, entre 1 y 4 resultados, la semilla y la salida JPEG o PNG.
Genera vídeos cinematográficos de 3 a 15 segundos a partir de texto, con sonido opcional.
Crea imágenes a partir de texto con hasta tres adaptadores LoRA y controla dimensiones, pesos y semilla.
Crea y edita imágenes desde texto con control preciso y resultados coherentes.
Cree imágenes rasterizadas, de ilustración digital o de estilo vectorial con controles detallados de estilo, tamaño y color.
Edita una imagen mediante un prompt, utiliza una máscara opcional y elige la relación de aspecto.
Genera imágenes fotorrealistas de hasta 2K con FLUX1.1 Pro Ultra.
Convierte texto en impactantes videos cinematográficos con precisión y estilo.
Crea videos realistas en segundos con Dreamina 3.0 y su potente IA de texto a video.
Crea videos cinematográficos en segundos con Veo 3.1 Fast, impulsado por texto y control creativo instantáneo.
Edita con Ideogram 3 una zona enmascarada de una imagen mediante un prompt.
Convierte texto en videos cinematográficos con control y detalle precisos
Convierte tus ideas en videos realistas con movimiento fluido y detalle vivo.
Genera con FLUX1.1 Pro imágenes detalladas, de composición precisa y fieles al prompt.
Genera imágenes fotorrealistas, con texto preciso y un control detallado del prompt.
Genera imágenes desde texto con Ideogram 3.0 y controla el formato, la velocidad, la paleta y el estilo.
Genere vídeos con Wan 2.1 mediante una URL de LoRA personalizada y controles detallados de salida y muestreo.
Da un nuevo estilo a un video existente con Tencent Hunyuan Video.
Crea una imagen con Imagen 4 Ultra a partir de un prompt y configura prompt negativo, relación de aspecto y semilla.
Crea un vídeo con Sora 2 Pro a partir de un prompt y elige el tamaño y la duración.
Genere una imagen a partir de un prompt obligatorio, con un prompt negativo opcional, 15 tamaños de salida, expansión Magic Prompt y control de semillas.
Remezcla con Ideogram 3 una imagen mediante un prompt y controla el peso de imagen, la relación de aspecto y otras opciones.
Edición cinematográfica con control de estilo y objetos
Anime una imagen de referencia requerida a partir de un prompt obligatorio. Controle el tamaño de salida, el recuento de fotogramas, la velocidad de fotogramas, la semilla, los pasos, la guía y el desplazamiento de muestreo.
Convierte tus imágenes en videos con calidad cinematográfica y control creativo total
Crea una imagen con Imagen 4 Fast desde un prompt y elige prompt negativo, relación de aspecto y semilla.
Añade con Pikadditions una persona o un objeto de una imagen a un vídeo existente.
Crea videos cortos con sonido y efectos desde texto en segundos
Anima con Pikaframes la transición entre una imagen inicial y otra final.
Convierte imágenes en videos animados con calidad profesional.
Cambia con Ideogram 3 Reframe la relación de aspecto y la resolución de una imagen.
Sustituye con Ideogram 3 el fondo de una imagen a partir de un prompt.
Anime una imagen requerida a partir de un prompt obligatorio. Controle el tamaño de salida, el recuento de fotogramas, la velocidad de fotogramas, la intensidad del movimiento de la cámara, el semilla, los pasos, la guía y el desplazamiento.
Animaciones realistas con control total de estilo, forma y ritmo.
Crea videos de alta calidad desde prompts de texto con Tencent Hunyuan Video.
Crea un vídeo con Kling 2.1 Master desde un prompt y elige duración, relación de aspecto, prompt negativo e intensidad.
Anima una imagen a partir de una pista de audio en modo de habla, canto o actuación.
Genere un video de 5 o 10 segundos a partir de un prompt obligatorio. Elija `16:9`, `9:16` o `1:1`, agregue un prompt negativo opcional y ajuste la intensidad del prompt.
Convierte una sola imagen en video aplicándole el Pikaffect que elijas.
Compón una escena a partir de 1–6 imágenes y anímala como vídeo con Pikascenes.
Crea un vídeo con Google Veo 3 a partir de un prompt de texto y elige si quieres generar audio.
Cree un vídeo de seis segundos a partir de un prompt de texto requerido con Hailuo 02 Pro y una expansión del prompt opcional.
Cree un video sincronizado con los labios a partir de las URL de audio y video requeridas. Elija `lipsync-2` o `lipsync-2-pro` (Pro cuesta aproximadamente 1,67 veces más por la misma duración) y seleccione uno de los cinco modos de duración no coincidente.
Más de 400 movimientos, 33 gestos faciales y realismo total
Convierte texto en imágenes nítidas con IA para proyectos creativos
Genera voz desde texto y sincronízala con un vídeo; permite elegir voz, idioma y velocidad.
Videos realistas con control de cámara y física avanzada
Sustituye una zona seleccionada de un vídeo mediante una máscara o una descripción, con imagen y prompt opcionales.
Crea videos de alta calidad a partir de prompts de texto con Pika 2.2.
Genere un video a partir de un prompt de texto obligatorio. Elija seis relaciones de aspecto, `540p`, `720p` o `1080p`, una duración de `5` o `9` segundos y bucle opcional.
Convierte texto o imágenes en videos profesionales y fluidos
Crea zooms digitales que amplían el contexto y la emoción visual
Dirige escenas con calidad profesional usando plantillas y comandos.
Convierte tus ilustraciones 2D en animaciones fluidas con IA avanzada.
Convierte texto o imágenes en videos cinematográficos precisos
Videos estilizados con colores planos y diseño minimalista para creadores.
Genera un vídeo de 5 u 8 segundos a partir de un prompt obligatorio, con un prompt negativo opcional, cuatro tamaños de salida exactos y control de semilla.
Segmenta un elemento de una imagen a partir de una breve descripción de texto.
Segmenta un elemento descrito a lo largo de los fotogramas de un vídeo.
Genera una imagen a partir de un prompt y elige la relación de aspecto y el seed.
Genera un vídeo a partir de dos pistas de audio y una imagen, y define el orden de los hablantes.
Procesa un vídeo existente con una pista de audio y añade, si lo necesitas, prompt y semilla.
Genere un vídeo 16:9 a partir de un prompt de texto, con duración, resolución, frecuencia de fotogramas y audio opcional.
Modifique un fragmento concreto de un vídeo mediante un prompt y sustituya el audio, la imagen o ambos.
Edita un vídeo existente mediante una instrucción de texto y la URL del vídeo.
Genera imágenes desde texto con prompt negativo, seis relaciones de aspecto y controles de muestreo.
Genere un vídeo de 5 o 10 segundos entre una imagen inicial y otra final, ambas obligatorias. Describa la transición en el prompt con @Image1 y @Image2.
Cree una toma nueva a partir de un vídeo de referencia y guíela con un prompt, elementos, imágenes, relación de aspecto, duración y audio original.
Edite un vídeo de referencia mediante un prompt y referencias opcionales de elementos o imágenes, y conserve el audio original si lo necesita.
Genera un vídeo a partir de un prompt de texto obligatorio con controles precisos de relación de aspecto, resolución, duración, estilo, semilla, audio, varios clips y optimización.
Crea un vídeo de transición entre una imagen inicial y una final obligatorias, con controles de prompt, relación de aspecto, resolución, duración, estilo, audio y optimización.
Genere imágenes a partir de texto con encuadres 16:9, 9:16 o 1:1, salida 1080p, 2k o 4k y control de semilla.
Genera desde texto una serie de hasta 15 imágenes y elige entre 11 opciones de resolución.
Cree un vídeo de avatar a partir de una imagen y un archivo de audio necesarios, con un prompt de texto opcional como guía de generación.
Genere una imagen a partir de texto con seis ajustes preestablecidos de tamaño exacto y controles para pasos de inferencia, orientación, semilla y salida JPEG, PNG o WebP.
Genere imágenes a partir de una imagen de control con hasta tres LoRAs, cuatro modos de preprocesamiento, influencia temporal de ControlNet y entre 1 y 8 pasos.
Transforma una imagen de origen con un prompt y hasta tres LoRAs en entre 1 y 8 pasos de inferencia.
Anima una imagen de referencia mediante el movimiento de un vídeo guía.
Edite una imagen de origen a partir de una instrucción escrita, con un prompt negativo opcional, semilla, modos de razonamiento y salida JPEG o PNG.
Anime la imagen de un personaje de referencia con movimiento de un video de conducción usando indicaciones positivas y negativas, además de configuraciones de generación ajustables.
Anime la imagen de un personaje de referencia con movimiento de un video de conducción usando controles de indicación, resolución, inferencia, guía de imagen y guía de pose.
Cree imágenes detalladas a partir de indicaciones escritas con controles de tamaño, fondo, calidad y formato de salida.
Anime una imagen requerida del primer fotograma a partir de un prompt de texto, guiando opcionalmente el final con una imagen del último fotograma.
Cree un vídeo a partir de un prompt de texto con una relación de aspecto seleccionable y una duración de 5 o 10 segundos.
Cambie el estilo de un vídeo existente con instrucciones de texto conservando el movimiento original y la composición general.
Flux 2 Turbo Text to Image genera imágenes detalladas a partir de texto con control de fidelidad al prompt, semillas reproducibles y formatos predefinidos.
Crea clips sincronizados a partir de prompts con control preciso del audio y del estilo mediante LoRA.
Transforma imágenes estáticas en clips dinámicos y expresivos con sonido sincronizado.
Transformación de vídeo eficiente con movimiento cinematográfico y precisión de diseño.
Texto a vídeo cinematográfico premium con la mayor fidelidad visual de la familia Kling V3.0.
Genera vídeos cinematográficos nativos en 4K a partir de texto, con diálogo sincronizado y personajes coherentes.
Convierte imágenes fijas en vídeos cinematográficos 4K nativos con una imagen inicial obligatoria, una imagen final opcional y sonido sincronizado.
Genera canciones de hasta 4 minutos con voces y letras a partir de etiquetas de estilo.
Edición de vídeo mediante prompts por $0.126 por segundo de salida.
Generación de vídeo de 3 a 15 segundos guiada por referencias por $0.084 por segundo.
Generación cinematográfica de texto a vídeo en 4K a 0,42 $ por segundo de salida.
Genera vídeos cinematográficos con audio sincronizado a partir de un prompt de texto.
Transforma texto e imágenes en videos realistas con control creativo
RunComfy es la principal ComfyUI plataforma, ofreciendo ComfyUI en línea entorno y servicios, junto con flujos de trabajo de ComfyUI con impresionantes imágenes. RunComfy también ofrece AI Models, permitiendo a los artistas aprovechar las últimas herramientas de AI para crear arte increíble.
