根据必填提示词调整一张源图的镜头角度或进行其他编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图以及 JPEG/PNG 输出。
| 参数 | 类型 | 默认值/限制 | 说明 |
|---|---|---|---|
| prompt | string | 少于 2000 个字符 | 描述目标图像的主体、风格、光线、氛围和构图。 |
| negative_prompt | string | 最多 500 个字符 | 指定需要避开的元素或画面特征。 |
| 参数 | 类型 | 默认值/限制 | 说明 |
|---|---|---|---|
| image_url | image_uri | 可选;JPEG/JPG/不含 Alpha 通道的 PNG/BMP/WEBP;单边 384~5000 px;最大 10 MB | 用于控制风格、主体一致性或编辑方向的参考图。 |
| 参数 | 类型 | 默认值/限制 | 说明 |
|---|---|---|---|
| image_size | string | 默认:1024*1024 (1:1);共 8 种固定尺寸 | 可选 10241024 (1:1)、8001200 (2:3)、1200800 (3:2)、9601280 (3:4)、1280960 (4:3)、7201280 (9:16)、1280720 (16:9) 或 1344576 (21:9)。 |
| max_images | integer | 默认:1;范围:1~5 | 设置单次生成数量上限;模型实际返回的图片可能少于该数值。 |
| seed | integer | 默认:0;范围:0~2147483647 | 固定随机种子有助于复现结果。 |
开发者可通过标准 HTTP 请求接入 RunComfy API,调用 Wan 2.6 Text to Image。提交提示词、可选参考图和输出尺寸,即可在创意流程或 CI/CD 管线中自动生成图片。
说明:Wan 2.6 Text to Image API 端点
如需生成动态画面和叙事内容,请使用 Wan 2.6 Text to Video:https://www.runcomfy.com/models/wan-ai/wan-2-6/text-to-video
如需让现有图片动起来,请使用 Wan 2.6 Image to Video:https://www.runcomfy.com/models/wan-ai/wan-2-6/image-to-video
根据必填提示词调整一张源图的镜头角度或进行其他编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图以及 JPEG/PNG 输出。
使用 6 种风格和 11 种宽高比,生成包含文字设计的视觉图片。
使用 Nano Banana 2 Edit 进行提示词驱动的图像编辑,支持多图输入,并可控制宽高比、分辨率、安全容忍度和输出选项。
根据文字生成图片,可设置负面提示词、6 种宽高比和采样参数。
使用 FLUX Kontext Max 根据提示词编辑图像,并设置随机种子和 9 种宽高比之一。
以文字生成高清逼真图像,灵活创作助力设计师灵感呈现
Wan 2.6 Text to Image 可根据文字提示生成高质量静态图像,还能使用可选参考图进一步控制画面风格、主体一致性或具体修改方向。模型注重准确遵循提示词、呈现真实纹理,并保持稳定构图。
Wan 2.6 Text to Image 将文生图与可选的参考图控制整合在同一流程中。相比不使用参考图的单次生成,它更适合重视视觉识别、品牌元素和定向修改的创作任务。
可选尺寸为 1024×1024(1:1)、800×1200(2:3)、1200×800(3:2)、960×1280(3:4)、1280×960(4:3)、720×1280(9:16)、1280×720(16:9)和 1344×576(21:9)。当前界面不支持其他尺寸或自定义宽高。
提示词须少于 2000 个字符,负向提示词最多 500 个字符。可选参考图须为 JPEG、JPG、PNG(不含 Alpha 通道)、BMP 或 WEBP 格式;单边需在 384~5000 像素之间,文件最大 10 MB。
在 RunComfy 模型界面完成测试后,可使用 API 密钥调用 Wan 2.6 Text to Image API 端点,通过 HTTP 提交提示词、可选参考图和输出尺寸。当前页面标示的价格为每张 $0.015;调用前请确认账户内有可用点数。
可选参考图用于提供主体特征和风格依据,提示词负责描述目标场景。持续使用同一张参考图并保持指令清晰,有助于提高一致性,但不能保证每次生成都完全相同。
不能。该模型只生成静态图像。如需视频,请使用 Wan 2.6 Text to Video 或 Wan 2.6 Image to Video;音频同步和口型同步不属于此文生图端点的功能。
该模型依据 Alibaba Cloud Model Studio 的相关条款提供。是否可商用取决于这些条款、所在地区和具体合同;模型页面注明免费方案不包含商业许可。正式发布前请务必查看最新许可条款。
max_images 可将生成数量上限设为 1~5 张,但模型实际返回的图片可能更少。使用 0~2147483647 范围内的固定 seed 有助于复现结果,但不保证整组图像在像素层面完全一致。
适合。竖版内容可选择 720×1280(9:16)、800×1200(2:3)或 960×1280(3:4);方形和横版素材还可选择 1:1、4:3、3:2、16:9 或 21:9。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





