来自图像、视频和音频提示的视频的开放权重参考。
Category
开放权重图像到视频,具有可选的最后一帧和原生立体声音频。
开放式文本转视频,具有 480p/768p 和原生立体声音频。
FLUX 3 Draft Extend: 720p 的快速低成本剪辑延续草稿
FLUX 3 草稿关键帧:720p 快速多关键帧视频预览
FLUX 3 Draft FLF:720p 快速开始结束帧视频预览
FLUX 3 Draft I2V:720p 快速静态视频预览草稿
Wan 2.6 Image-to-Image:基于指令的AI,实现无缝视觉编辑和可扩展的风格适配
使用 Seedream 4.5 Edit 图像编辑转换视觉内容,实现连贯的照片级真实图像创建和精准的品牌一致性。
由参考图引导的图像编辑,支持版式控制、图层分离和多语言文字
将静态画面转为动作流畅、音频可控的视频片段。
利用Wan 2.5,将静态图像高效转换为动态视频,轻松打造创意视觉内容。
FLUX 3 Draft:快速、低成本的 720p 文本转视频预览
Seedance 2.5 FLF2V 480p:更低成本的首末帧草稿转场
Seedance 2.5 Reference 480p:更低成本的多参考草稿视频
Seedance 2.5 480p:快速、低成本的静图转动画草稿
Seedance 2.5 480p:用提示词快速、低成本生成文生视频草稿
通过场景一致的运动将现有剪辑延长到最终帧之外
从带有可选音频的多关键帧静态图像生成视频
根据起始帧与结束帧生成可选原生音频的过渡视频
将起始静帧动画化为可选原生音频的短视频
Seedance 2.5 First & Last Frame:将开始画面与结束画面衔接为流畅的电影级视频
Flux 2 Flash Edit 可根据明确的文字指令编辑最多 4 张参考图,并精确控制尺寸和输出格式。
使用Nano Banana Pro将草图转化为精确的2K-4K视觉效果,智能校正与无缝创意控制。
根据必填提示词编辑或融合 1–10 张必填 JPEG 或 PNG 图像。可选择 `1K`、`2K`、`4K` 或八种固定分辨率。
将静态图变成动作自然、对白同步且创作可控的逼真视频场景。
WAN 2.7 图像编辑支持 1–4 张参考图进行文字指令编辑,并提供可选的提示词扩写、中英文指令和预设输出尺寸。
生成品牌视觉素材,准确呈现图片内文字和 Logo。
基于 LoRA 的图像编辑模型,可在保持结构和主体一致性的同时精准修改创意素材。
OpenAI 的 GPT Image 2 图像编辑:通过精确的文本控制和输入输出绘画进行图像到图像编辑
使用 Nano Banana 2 Edit 进行提示词驱动的图像编辑,支持多图输入,并可控制宽高比、分辨率、安全容忍度和输出选项。
只需一条提示词,即可根据参考图生成流畅的 720P 或 1080P 视频。
根据文字生成 4–12 秒视频,支持 480p、720p、1080p、6 种宽高比,以及音频和固定镜头设置。
使用Hailuo 2.3 Fast Standard将静态图像快速生成流畅逼真的视频,助力设计师轻松实现创意动态化。
Seedance 2.5:将静态图片转化为电影级 AI 视频
Seedance 2.5 Reference to Video:根据参考素材生成电影级 AI 视频
根据文字提示词生成 5 秒、10 秒或 15 秒视频,可添加源音频,并设置尺寸、镜头结构、反向提示词、随机种子、提示词扩写和生成音频。
MiniMax H3:768p/2K 文本转视频,带原生立体声音频
根据必填提示词生成图像,可从六种固定尺寸预设中选择,并设置整数随机种子;`seed` 默认值 `-1` 表示随机取种。
从图像、视频和音频参考生成 768p 或 2K 视频
通过文字指令和最多 10 张源图进行图像编辑,并可选择七种尺寸以及 JPEG 或 PNG 输出。
智能图像转视频工具,让创作者轻松生成高清动态影像,掌握视觉创意节奏。
轻松将文字创意转换为高清图像,支持多输入融合与灵活编辑,助力设计高效创作
高保真 4 步文本到图像,具有清晰的文本渲染
3–15s 专业级电影感图生视频,输出每秒 $0.112 起。
根据提示词编辑或组合 1–10 张图像,并设置宽高比、格式和输出数量。
Flux 2 Turbo Edit 可根据明确的文字指令编辑最多 4 张参考图,并精确控制尺寸和输出格式。
使用Wan 2.6将静态图像转换为动态同步的高清视频内容,支持灵活控制。
支持文字、图像和参考素材输入,并可同步生成原生音频的多模态 AI 视频模型。
仅通过文字生成图片,并可选择 2K、4K 或 9 个固定尺寸。
具备版式与图层控制的文生图和图像编辑模型
生成 2K 电影感视频,支持精准口型同步与镜头控制。
阿里巴巴的 HappyHorse 1.0 Video Edit可以编辑输入视频,其中包含文本说明和参考图像,以进行风格转移、本地替换和服装交换。
根据提示词生成 1–4 张图片,并设置宽高比、分辨率、格式和返回方式。
只需一条提示词,即可将静态照片转化为流畅的 720P 或 1080P 视频。
根据文字提示词和 1~3 段参考视频生成视频,并可设置时长、输出尺寸、镜头结构、随机种子、反向提示词和音频生成。
使用 Seedance 1.5 Pro 将静态图像转换为具有流畅、逼真过渡和创意灵活性的电影级视频片段。
根据提示词生成 1–4 张图片,并可选择宽高比、推理步数、随机种子和文件格式。
按每秒 $0.084,将图像制作成 3–15 秒视频。
使用 Nano Banana 2 进行快速、高质量的文生图,支持宽高比、安全容忍度和输出格式控制。
将第一帧图像动画化为 768p 或 2K 视频,最长 15 秒
根据提示词编辑或转换最多 20 张参考图片,并设置生成数量、格式、宽高比和分辨率。
利用Seedance 1.0 Pro Fast轻松将静态图像变为电影级动态视频,释放创作无限可能。
以Seedance 1.0将静态图像瞬间变成电影级动态视频,创作过程高效流畅。
精准中文渲染与多语种图像编辑,助力创意设计
上传 1~14 张参考图,按文字指令进行编辑,并设置最多 15 张序列输出。
快速、低成本的提示词图像编辑模型,以固定 1K 分辨率输出。
通过多参考素材和帧控制生成 1080p 视频片段。
将图像或音频参考转为动作可精确控制的高清视频。
通过精细控制和可复现设置,快速生成准确的设计视觉。
根据文本提示词生成海报、标志和以字体排版为核心的图像。
Seedream 5.0 Lite 文本生成图像:支持精确布局与字体排版控制的提示词到视觉引擎
Seedance 2.5:一致性更强、支持更长片段的电影级 AI 视频
智能将文字转化为精美图片,轻松创作与编辑视觉内容,激发无限设计灵感
高级图像编辑模型,可在精准修改画面的同时保持几何结构与主体一致性。
FLUX 3 Image 是一款支持参考图引导和清晰文字生成的多模态图像模型
Kling 3.0:创建具有同步对话和一致角色的多场景电影。
将起始图像制作成带原生音频的电影感短片。
高保真电影感动作模型,可流畅迁移动作并灵活控制画面。
支持双语文本精修与图像风格控制,助力创意设计高效实现
根据提示词生成写实图像,精准呈现中英文文字,并保持均衡稳定的版式。
使用 Wan 2.2 Plus 根据提示词生成 5 秒视频,并设置尺寸、随机种子和提示词扩展。
WAN 2.7 Pro 图像编辑支持 1–4 张参考图、提示词扩写和高品质指令编辑,操作字段与标准编辑版本一致。
根据文字提示词生成图像,并可设置六种预设尺寸、随机种子以及 JPEG 或 PNG 输出。
Prompt-driven Pro-tier video editing at $0.168 per second.
根据最多三张源图进行图像编辑,并可调整引导强度、推理步数、输出数量、提示词扩展、尺寸、随机种子和格式。
Sora 2 轻松将图像转化为逼真视频,视觉与音频自然同步,激发创意灵感。
使用 FLUX Kontext Pro 根据必填文本指令编辑一张必填图片,并可设置种子和 9 种宽高比。
将静态图像快速转换为逼真动态视频,支持1080p高质量创作,释放视觉创意潜能
通过 AI 转换现有视频,同时保持动作稳定和设计一致。
将一张参考图制作成 5 秒或 10 秒的视频,并可设置反向提示词与原生音频生成。
根据提示词让起始图像动起来,并设置 LoRA、帧数、FPS、分辨率、宽高比、推理步数和随机种子。
Seedream 5.0 Lite 将参考图像转化为布局精准、风格一致的设计,助力创意工作流。
根据文本生成精致图像,通过精准细节与灵活风格控制服务设计工作流。
根据图片和提示词生成 5 秒或 8 秒的 480p 或 720p 视频。
根据风格标签和歌词生成最长 4 分钟、带人声的歌曲。
使用Veo 3.1 Fast轻松将图片或文字转化为高质量电影级视频,创作高效灵活。
根据必填提示词生成 5 秒或 10 秒视频。可添加选填 WAV/MP3 音频、反向提示词,并从 13 种输出尺寸中选择。
通过精准的风格与连贯控制,构建自然衔接的创意视觉序列。
Kling V3.0 系列中画面品质与动作真实感最高的高端图生视频模型。
根据提示词和最多 7 张参考图生成图片,并可选择宽高比、1080p 至 4k 分辨率和随机种子。
将源视频放大到所选目标分辨率和帧率。
根据文字、参考音频或图像生成自然的语音与音频。
使用参考图和源视频生成动画视频,可选择输出尺寸并设置随机种子。
智能将静态图像转换为动态视频,轻松生成高清创意内容,助力设计与营销表达。
根据文字生成图片,并以独立权重组合最多 3 个 LoRA。
使用 FLUX Kontext Max 根据提示词编辑图像,并设置随机种子和 9 种宽高比之一。
通过摄像机和音频控制将静态照片转变为电影动作剪辑。
根据参考图像和提示词生成带同步音频的短视频。
将文字创意转化为符合品牌调性的视觉内容,并精确控制画面风格。
根据文字指令编辑 1–10 张参考图片,并选择固定尺寸预设、随机种子以及 JPEG 或 PNG 输出。
根据文本指令编辑源视频,同时保持场景结构与动作连贯。
使用一张人像和一段音频生成口播数字人视频,并可通过提示词引导动作与表达方式。
使用 Hailuo 02 Pro 根据提示词让起始图像动起来,生成 6 秒视频。
Hailuo 2.3 让设计师轻松将静态图像转换为逼真动态视频,精准控制每一帧细节,激发创意灵感。
以两张图像生成高保真视频,自动插帧呈现流畅过渡,助力创意视频设计。
根据一张必填人物图像和一段 35 秒以内的必填音频生成视频。可使用六种支持语言填写选填生成指引,并设置默认值为 -1 的随机种子。
达到 Seedance 2.0 水准的电影级视频生成,兼具出色的视觉保真度与自然的镜头运动
Alibaba 上的 HappyHorse 1.0 I2V 将静态图像动画化为原生 1080p 视频,具有物理精确的运动和身份稳定的主题。
根据文字提示创建新图像,可选择 6 个固定尺寸预设、随机种子以及 JPEG 或 PNG 输出。
根据文字提示词生成图片,每次可输出 1–10 张。
通过首帧风格控制,让AI视频从始至终保持统一视觉效果,轻松实现创意再现。
4 步亚秒级文本到图像,具有即时准确的视觉效果
根据提示词转换一张输入图片,并可设置变换强度、尺寸、1–8 个推理步、随机种子、提示词扩展以及 JPEG、PNG 或 WebP 输出。
在音轨开头、结尾或两端续写风格一致的新内容。
根据文字指令编辑或转换 1–10 张参考图片,并精确设置尺寸、背景、质量、输入保真度与输出格式。
通过多模态参考、口型同步和镜头控制,更快生成具有电影感的短视频。
利用Dreamina 3.0快速将静态图像转化为2K高质量动态视频,让创意更生动自然。
根据必填文本提示词生成音画同步视频。输出尺寸可选 `1280x720` 或 `720x1280`,时长可选 `4`、`8` 或 `12` 秒。
FLUX 3 Video 可将文本提示词生成带原生音频的电影感短片
WAN 2.7 文生图:精准理解提示词,提供多种尺寸预设,每次最多生成 5 张图像
轻松将图片生成高品质动态视频,展现真实光影与自然运动效果。
编辑单张图片的皮肤细节,并设置尺寸、步数、引导强度、生成数量、格式和随机种子。
将静态人像转化为表情自然、栩栩如生且可精细控制的视频。
通过提示词编辑 1–10 张图片,并调整尺寸、提示词扩展、引导强度、步数、随机种子和格式。
根据起始图片和提示词生成 16:9 视频,可选择时长、分辨率、帧率以及是否生成音频。
根据 800 字符以内的必填指令编辑 1–3 张必填源图像。可请求 1–6 张结果,添加 500 字符以内的反向提示词,并设置 0–2147483647 的随机种子。
快速、低成本的文生图模型,以固定 1K 分辨率输出。
使用 Kling 2.1 Standard 根据必填图片和提示词生成视频,并可设置时长、宽高比、负面提示词和提示词强度。
结合必填的人像图片、参考视频和提示词,生成表情与动作自然的人像动画。
根据必填提示词生成 1–4 张图像,并可选择 10 种宽高比、1K/2K/4K 分辨率、三种文件格式和同步返回模式。
WAN 2.7 Pro 文生图模型,采用与标准版相同的操作方式,支持中英文提示词,每次最多生成 5 张适合印刷和大幅面设计的高精度静态图像。
利用AI将静态照片快速生成自然口型、表情生动的视频内容,轻松实现人像开口说话效果。
根据必填提示词组合或编辑 1–10 张源图,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图、随机种子以及 JPEG/PNG 输出。
让静态图片化身高清动态影像,Hailuo 2.3 Pro助你轻松创建逼真1080p视频。
将静态图片快速生成高质量2K动态视频,精准还原创意细节,助力设计与视觉表达。
根据文字提示词改造源视频,并支持原生音频。
将驱动视频中的动作迁移到参考角色图片,同时尽量保持角色可辨识。
快速文本转图像工具,精准高效,适合创意和开发场景
新一代AI图像工具,将文字精准转化为高质量视觉作品,助力创意设计与图像编辑。
通过蒙版精准局部重绘,完成照片精修、物体修改与场景修复。
根据提示词让必填源图片动起来,可精确选择 6、8 或 10 秒,1080p~2160p,25 或 50 FPS,固定 16:9,并可生成音频。
使用 6 种风格和 11 种宽高比,生成包含文字设计的视觉图片。
智能文本转视频工具,支持1080p高质量生成,轻松打造生动镜头与真实情感,激发创作灵感。
根据必填提示词编辑 1–10 张源图像,并可按需应用最多三个 LoRA 条目。可选六种输出尺寸,并可设置推理步数、引导强度、1–4 张结果、随机种子以及 Default、JPEG 或 PNG 输出。
电影感 4K 图生视频,输出每秒 $0.42。
轻松将图像转化为高质量视频,支持音效同步与场景控制,助力创意呈现
使用Veo 3.1 Fast快速将静态图像转换为电影级视频,轻松实现创意动画制作。
将静态图像和文字提示快速生成逼真高清视频,展现自然动态效果。
根据提示词生成视频,并设置 LoRA、分辨率、宽高比、帧数、FPS、推理步数和随机种子。
使用 48 个效果预设之一为 1 张必填源图片制作动画,并可设置分辨率、时长、反向提示词和提示词优化。
使用 Kling 2.1 Pro 根据必填起始图片和提示词生成视频,并可设置选填结束图片、时长、宽高比、负面提示词和提示词强度。
为设计师提供高精度图像转换与4K视觉生成,轻松打造独特风格作品。
使用 Hailuo 02 根据一段必填文本提示词生成 6 秒或 10 秒视频,并可选择提示词扩展。
根据图片、音频和提示词生成视频,并分别调整文字与音频的引导强度。
精确重制音轨中的指定片段,其余部分保持不变。
专业级电影感文生视频,输出每秒 $0.112。
使用 Wan 2.2 Plus 根据提示词生成图像,并设置尺寸、随机种子和提示词扩展。
从图像轻松生成高质量视频,支持风格控制与镜头运动。
输入文字即可生成短视频,并可设置时长、宽高比与是否生成音频。
根据 2000 字符以内的必填提示词生成图像。可填写选填反向提示词,并从 13 种输出尺寸中选择。
精准理解提示,流畅生成动画,高品质图像到视频创作体验。
智能将静态图片转换为流畅视频,场景衔接自然,创作更轻松。
根据必填视频 URL 和音频 URL 创建口型同步视频,并可从五种模式中选择音视频时长不一致的处理方式。
使用最多 3 张图片与 3 个 LoRA 进行编辑,并可控制 6 个精确尺寸预设、提示词引导强度、推理步数、随机种子以及 JPEG、PNG 或 WebP 输出。
专业级参考图生视频,支持 3–15s 输出,每秒 $0.112 起。
使用必填音频驱动一段短视频,并控制情绪、编辑范围、音视频时长不一致时的处理方式和表现力。
通过智能帧插值,将静态图像平滑转换为高质量视频,提升创作表现力。
根据必填提示词和一张必填源图像,创建下一场景的编辑图像。可选六种输出尺寸,并可设置 2–50 步推理、0–20 的引导强度(默认值:6)、1–4 张结果、随机种子以及 JPEG 或 PNG 输出。
根据必填提示词编辑一张源图,并可设置可选蒙版、2–50 推理步、480p/720p 分辨率、随机种子和三种输出格式。
根据必填提示词编辑一张必填参考图像。可请求 1–4 张结果,选择 PNG、JPEG 或 WebP 输出,并可通过 `sync_mode` 返回 data URI。
以 AI 精准迁移动作,快速生成稳定流畅的角色动画。
快速、低成本的多镜头 AI 视频模型,原生支持音频和参考素材。
根据文字生成图片,并调整尺寸、提示词扩展、引导强度、步数、随机种子和格式。
使用一段音频和一张图片生成视频,并可按需设置提示词和随机种子。
通过蒙版精准局部重绘,并可叠加 LoRA,快速完成商品图与创意图片修改。
根据必填文本指令编辑一张必填图片,并可设置提示词扩展、两种输出分辨率、种子和输出格式。
根据提示词将现有视频续写 7 秒,以 720p 输出,并可选择是否生成音频。
根据提示词修改现有场景中的元素,并设置尺寸、步数、引导强度、生成数量、格式和随机种子。
通过提示词创作歌曲,支持 44.1 kHz WAV 输出与分段编辑。
支持文字控制图像编辑,具备风格记忆与多层细化能力
HappyHorse 1.0 提供原生 1080p 输出、电影级运动与多镜头一致性。
将一张静态图像生成带同步音频的短视频。
使用 Fast 版本移除视频背景,并设置输出编码、边缘优化与主体类型。
将图像分解为可编辑的 RGBA 图层,实现精准对象隔离和灵活设计控制。
以智能序列和风格一致的图像生成为设计师打造连贯的视觉故事体验。
根据必填提示词生成视频,可精确选择 6、8 或 10 秒,1080p~2160p,25 或 50 FPS,固定 16:9,并可生成音频。
轻松将静态图像转为动态视频,拥有自然光影与流畅动画效果,为创作者解锁全新视觉表现力。
电影感 4K 参考图生视频,输出每秒 $0.42。
根据必填提示词调整一张源图的镜头角度或进行其他编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图以及 JPEG/PNG 输出。
用文字驱动起始图片生成视频,并设置宽高比、分辨率、时长、风格、音频与多片段。
HappyHorse 1.0 参考视频将多达 9 个参考图像和提示融合成一个具有稳定身份的连贯多字符剪辑。
以AI驱动的图像转视频工具,快速生成流畅高质的动态画面,激发无限创意。
通过必填参考图片与元素数组生成视频,使用按顺序编号的 @Image 和 @Element 标记,并精确控制时长与宽高比。
高效AI文本转视频工具,轻松将创意脚本变为生动影片,助力设计师快速呈现视觉故事。
使用 Kling 2.5 Turbo 根据提示词生成视频,并设置时长、宽高比和负面提示词。
将视频中的人物或物体与背景分离,并设置输出编码、边缘优化与主体类型。
使用 Seedance 1.0 根据提示词生成视频,并设置分辨率、宽高比和时长。
使用Veo 3.1将静态图像一键转化为逼真动态视频,轻松实现创意叙事与视觉表达。
根据文字提示词编辑 1 张源图片,并可设置推理步数、引导强度、随机种子以及 JPEG、PNG 或 WebP 输出。
Veo 3.1 帮助设计师快速将图像转换为高质量动态视频,创作流畅又真实的视觉作品。
智能文本生成图像模型,精准高效,助力设计师灵感创作与细节优化。
使用 Sora 2 Pro 根据提示词让参考图动起来,并选择输出尺寸和时长。
通过文字指令编辑现有视频,可添加最多 10 张参考图片,并选择是否保留原声。
根据提示词将现有视频续写 7 秒,以 720p 输出,并可选择是否生成音频。
使用 Wan 2.1 根据文本提示词生成视频,并设置分辨率、宽高比、帧数、帧率等选项。
精准匹配文本提示,生成动作真实、结构连贯的视频内容
根据提示词生成图像,并设置 LoRA、图像尺寸、格式、推理步数、负面提示词和随机种子。
对一张必填输入图片进行放大,并可调整推理步数、LoRA 作用强度、种子和输出格式。
移除视频背景,并根据后期流程调整输出编码与色溢抑制强度。
修复并放大一段必填源视频。可设置输出宽度、加载帧数、播放帧率、随机种子、修复强度和批量大小。
将音频轨道与视频同步,并设置是否循环视频。
通过两个必填 URL,将音频轨道与现有视频同步。
根据必填提示词为一张源图重新布光或进行编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图、随机种子以及 JPEG/PNG 输出。
根据文字生成 3–15 秒电影感视频,并可选择同步音频。
根据文字生成图片,可叠加最多 3 个 LoRA,并调整尺寸、权重和随机种子。
高精度文字控制与快速生成,实现一致画面效果的智能图像创作工具。
通过丰富的风格、尺寸与配色设置,生成位图、数字插画或矢量风格图片。
根据提示词编辑图像,可选使用遮罩,并设置宽高比。
使用 FLUX1.1 Pro Ultra 生成最高 2K 的写实图片。
用Dreamina 3.0将文字转化为高质量电影画面,让创意以视频形式精准呈现。
Dreamina 3.0助力设计师快速将文字创意变为动态真实画面,轻松打造高质量视频内容。
使用 Veo 3.1 Fast,从文字或图像快速生成高质感视频,轻松实现创意与动态表达。
使用 Ideogram 3 根据提示词编辑图像中的遮罩区域。
通过Veo 3.1文本转视频技术,轻松创作高质量影视级动画,精准控制画面与音效融合。
从文本轻松生成生动短视频,Hailuo 2.3 让创作更高效、更具表现力。
使用 FLUX1.1 Pro 生成构图精准、细节丰富且符合提示词的图片。
通过精细的提示词控制,生成写实且文字呈现准确的图片。
使用 Ideogram 3.0 根据文本生成图片,并设置宽高比、速度、配色和风格。
应用一个自定义 LoRA,并通过详细的输出与采样设置生成 Wan 2.1 视频。
使用腾讯 Hunyuan Video 将现有视频转换为新的视觉风格。
使用 Imagen 4 Ultra 根据提示词生成图像,并设置负面提示词、宽高比和随机种子。
使用 Sora 2 Pro 根据文本提示词生成视频,并选择输出尺寸和时长。
根据必填提示词生成图像。可设置选填反向提示词、15 种输出尺寸、Magic Prompt 扩写和随机种子。
使用 Ideogram 3 根据提示词重混图像,并设置图像权重、宽高比等选项。
支持风格控制与物体编辑的电影级AI视频生成工具
根据必填提示词将一张必填的参考图像制作成视频。可设置输出尺寸、帧数、播放帧率、随机种子、步数、引导强度和 shift。
以FusionX轻松将图像生成电影质感视频,精准控制创意与细节
使用 Imagen 4 Fast 根据提示词生成图像,并设置负面提示词、宽高比和随机种子。
使用 Pikadditions 将图像中的人物或物体添加到现有视频中。
快速将文字转化为带音效的短视频,灵活高效又省钱
使用 Pikaframes 为起始图片与结束图片之间的变化生成流畅动画。
Pika 2.2 让设计师轻松将图片或文字提示转化为高质量视频,快速实现创意动画。
使用 Ideogram 3 Reframe 更改图像的宽高比和分辨率。
使用 Ideogram 3 根据提示词替换图像背景。
根据必填提示词将一张必填的图像制作成视频。可设置输出尺寸、帧数、播放帧率、镜头运动强度、随机种子、步数、引导强度和 shift。
高还原度视频生成,轻松操控结构、风格与动作,创作更自由
使用腾讯 Hunyuan Video 根据文本提示词生成高质量视频。
使用 Kling 2.1 Master 根据提示词生成视频,并设置时长、宽高比、负面提示词和提示词强度。
根据一张图片和一段音频,生成说话、唱歌或表演视频。
根据必填提示词生成 5 秒或 10 秒视频。可选择 `16:9`、`9:16` 或 `1:1`,填写选填反向提示词,并调整提示词强度。
为单张图片应用所选 Pikaffect 特效,并将结果生成视频。
使用 1–6 张图像组合场景,并通过 Pikascenes 将其制作成动态视频。
使用 Google Veo 3 根据文本提示词生成视频,并选择是否生成音频。
使用 Hailuo 02 Pro 根据一段必填文本提示词生成 6 秒视频,并可选择提示词扩展。
根据必填视频 URL 和音频 URL 创建口型同步视频。可选择 `lipsync-2` 或 `lipsync-2-pro`;相同时长下,Pro 费用约为基础版的 1.67 倍。另有五种时长不一致处理模式。
支持33种表情与400+动作组合,打造电影质感AI短视频
以文字生成高清逼真图像,灵活创作助力设计师灵感呈现
根据文本生成语音并与视频同步,可选择音色、语言和语速。
支持精准动作、镜头控制与真实物理感,助力创意视频设计
通过遮罩或区域描述替换视频中的选定区域,并可按需使用图像和提示词。
使用 Pika 2.2 根据文本提示词生成高质量视频。
根据必填文本提示词生成视频。可选择六种宽高比、`540p`/`720p`/`1080p`、`5` 秒/`9` 秒,以及是否循环播放。
将文字图像一键转化为电影级视频,支持角色一致与风格统一
内置镜头运动指令与分镜模板,轻松实现高质量影视创作
让2D插画轻松动起来,支持多风格、高保真的AI动态生成
AI驱动的图像与文本转视频工具,为创作者提供灵活高效的视觉创作体验
根据必填提示词生成 5 秒或 8 秒视频,并可设置负面提示词、四种精确尺寸和随机种子。
用简短文字指定目标,对图片中的相应区域进行分割。
根据文字描述,在视频的连续画面中分割指定目标。
根据文本提示词生成图片,并设置宽高比和随机种子。
使用两段音频和一张图片生成视频,并设置两位人物的发言顺序。
使用一段音频处理现有视频,并可按需设置提示词和随机种子。
根据文字提示词生成 16:9 视频,可选择时长、分辨率、帧率以及是否生成音频。
根据提示词重做现有视频中的指定片段,并可选择替换音频、画面或同时替换两者。
通过视频 URL 和文字指令编辑现有视频。
根据文字生成图片,可设置负面提示词、6 种宽高比和采样参数。
在必填起始图片与结束图片之间生成 5 秒或 10 秒视频,并通过包含 @Image1 和 @Image2 引用的必填提示词引导转场。
以参考视频生成新镜头,可使用提示词、元素和图片,并选择画面比例、时长及是否保留原始音轨。
使用提示词编辑参考视频,可加入元素与图片参考,并可选择保留原始音轨。
根据必填文字提示词生成视频,并精确控制宽高比、分辨率、时长、风格、随机种子、音频、多片段和提示词优化。
以必填的起始图片和结束图片生成转场视频,并可控制提示词、宽高比、分辨率、时长、风格、音频和提示词优化。
根据文本生成图片,可选择 16:9、9:16 或 1:1 宽高比、1080p/2k/4k 输出和随机种子。
仅用文字生成最多 15 张序列图片,并可从 11 个分辨率选项中选择。
根据 1 张必填图片和 1 个必填音频文件生成数字人视频,并可用文字提示词补充生成指令。
根据文字生成图片,提供 6 个精确尺寸预设,并可设置推理步数、引导强度、随机种子以及 JPEG、PNG 或 WebP 输出。
根据一张控制图片生成新图,支持最多 3 个 LoRA、4 种预处理模式、分阶段 ControlNet 控制及 1–8 个推理步。
结合原图、提示词和最多 3 个 LoRA 完成图片转换,推理步数可设为 1–8。
根据驱动视频中的动作,让参考图片动起来。
根据文字指令编辑一张源图片,并可设置反向提示词、随机种子、思考与反思模式,以及 JPEG 或 PNG 输出。
将驱动视频中的动作迁移到参考角色图片,并可设置正向/反向提示词和生成参数。
将驱动视频中的动作迁移到参考角色图片,并可调整提示词、分辨率、推理步数、图像引导与姿态引导。
根据文字提示生成细节丰富的图像,并可设置尺寸、背景、质量与输出格式。
根据必填提示词让首帧图像动起来,并可通过可选的尾帧图像控制视频结尾。
根据文字提示词生成视频,可选择宽高比以及 5 秒或 10 秒时长。
通过文字指令重塑现有视频,同时尽量保留源视频的动作与整体构图。
Flux 2 Turbo Text to Image 可根据文字快速生成高质量图像,并控制提示词遵循度、随机种子、宽高比和输出格式。
根据提示词生成音视频同步的动态短片,并精确控制 LoRA 风格。
将静态图像转化为富有表现力的动态短片,并生成同步音频。
以电影级动作表现和精细创作控制,高效转换现有视频。
Kling V3.0 系列中具有最高视觉保真度的优质电影文本转视频。
生成带同步对白和一致角色的原生 4K 电影感文生视频。
将静态图像制作成原生 4K 电影感视频,支持首尾帧引导与同步音频。
根据文本标签生成最长 4 分钟、带人声与歌词的歌曲。
按输出视频每秒 $0.126,通过提示词编辑视频。
根据参考素材生成 3–15 秒视频,起价为每秒 $0.084。
电影感 4K 文生视频,输出每秒 $0.42。
根据文本提示词生成带同步音频的电影级视频。
从文本或图片生成高质量动态视频,轻松掌控节奏和真实感
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。
