来自图像、视频和音频提示的视频的开放权重参考。




flux-3/text-to-video
FLUX 3 Video 可根据文本提示生成最长 20 秒、可选原生音频的 720p 或 1080p 视频。
seedance-2.5/text-to-video/720p
Seedance 2.5 可根据文本和参考素材生成电影级视频,支持原生音频,参考一致性更强,镜头延长后依然清晰,适用于广告、电影预演和品牌叙事。
seedream-5.0-pro/text-to-image
Seedream 5.0 Pro 可根据文字和参考图生成或编辑图像,并提供精确的版式控制、图层分离和可靠的多语言排版,适用于品牌、产品与营销设计。
happyhorse-1.1/text-to-video
Happy Horse 1.1 是 Alibaba 推出的多模态视频模型,覆盖文字、图像、参考图生视频和视频编辑,并原生支持音频。此页面运行其文生视频模式,可生成 720P/1080P、3-15 秒的视频。
Seedance 2.5:一致性更强、支持更长片段的电影级 AI 视频
Seedance 2.5 First & Last Frame:将开始画面与结束画面衔接为流畅的电影级视频
Seedance 2.5:将静态图片转化为电影级 AI 视频
Seedance 2.5 Reference to Video:根据参考素材生成电影级 AI 视频
具备版式与图层控制的文生图和图像编辑模型
由参考图引导的图像编辑,支持版式控制、图层分离和多语言文字
Seedream 5.0 Lite 将参考图像转化为布局精准、风格一致的设计,助力创意工作流。
Seedream 5.0 Lite 文本生成图像:支持精确布局与字体排版控制的提示词到视觉引擎
使用 FLUX Kontext Max 根据提示词编辑图像,并设置随机种子和 9 种宽高比之一。
使用 FLUX Kontext Pro 根据必填文本指令编辑一张必填图片,并可设置种子和 9 种宽高比。
支持文字控制图像编辑,具备风格记忆与多层细化能力
智能文本生成图像模型,精准高效,助力设计师灵感创作与细节优化。
快速、低成本的提示词图像编辑模型,以固定 1K 分辨率输出。
快速、低成本的文生图模型,以固定 1K 分辨率输出。
使用 Nano Banana 2 进行快速、高质量的文生图,支持宽高比、安全容忍度和输出格式控制。
使用 Nano Banana 2 Edit 进行提示词驱动的图像编辑,支持多图输入,并可控制宽高比、分辨率、安全容忍度和输出选项。
WAN 2.7 文生图:精准理解提示词,提供多种尺寸预设,每次最多生成 5 张图像
WAN 2.7 Pro 文生图模型,采用与标准版相同的操作方式,支持中英文提示词,每次最多生成 5 张适合印刷和大幅面设计的高精度静态图像。
WAN 2.7 图像编辑支持 1–4 张参考图进行文字指令编辑,并提供可选的提示词扩写、中英文指令和预设输出尺寸。
WAN 2.7 Pro 图像编辑支持 1–4 张参考图、提示词扩写和高品质指令编辑,操作字段与标准编辑版本一致。
根据提示词将现有视频续写 7 秒,以 720p 输出,并可选择是否生成音频。
根据提示词将现有视频续写 7 秒,以 720p 输出,并可选择是否生成音频。
使用Veo 3.1将静态图像一键转化为逼真动态视频,轻松实现创意叙事与视觉表达。
使用Veo 3.1 Fast轻松将图片或文字转化为高质量电影级视频,创作高效灵活。
具备版式与图层控制的文生图和图像编辑模型
由参考图引导的图像编辑,支持版式控制、图层分离和多语言文字
根据文字生成图片,可叠加最多 3 个 LoRA,并调整尺寸、权重和随机种子。
使用 Seedream 4.5 Edit 图像编辑转换视觉内容,实现连贯的照片级真实图像创建和精准的品牌一致性。
为设计师提供高精度图像转换与4K视觉生成,轻松打造独特风格作品。
利用Dreamina 3.0快速将静态图像转化为2K高质量动态视频,让创意更生动自然。
将静态图片快速生成高质量2K动态视频,精准还原创意细节,助力设计与视觉表达。
新一代AI图像工具,将文字精准转化为高质量视觉作品,助力创意设计与图像编辑。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。
