高级图像编辑模型,可在精准修改画面的同时保持几何结构与主体一致性。
Qwen Edit 2509 Next Scene 会根据必填文本提示词和一张源图像,创建下一场景的编辑图像。
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| prompt | string | 必填;已预填示例 | 描述所需编辑内容的文字指令。 |
| image_urls | 图像 URI 数组 | 只能包含 1 张图像;必填 | 提供且仅提供一个可直接访问的源图 URL。 |
| image_size | string | 默认:landscape_16_9 | 可选 square_hd、square、portrait_4_3、portrait_16_9、landscape_4_3 或 landscape_16_9。 |
| num_inference_steps | integer | 2–50;默认:28 | 推理步数。 |
| guidance_scale | float | 0–20;默认:6 | 数值越高,结果越贴近 prompt。 |
| num_images | integer | 1–4;默认:4 | 结果图数量。 |
| output_format | string | jpeg 或 png;默认:png | 结果图的文件格式。 |
| seed | integer | 默认:4571632 | 用于控制生成过程的随机种子。 |
| negative_prompt | string | 可选;默认留空 | 希望结果避开的内容。 |
image_urls 中加入一张源图。prompt 中描述下一场景需要呈现的内容。image_size 值之一。num_inference_steps 设为 2–50,并将 guidance_scale 设为 0–20。num_images 设为 1–4,然后在 output_format 中选择 jpeg 或 png。seed;需要说明避开的内容时填写 negative_prompt。The rate is $0.039 per image.
高级图像编辑模型,可在精准修改画面的同时保持几何结构与主体一致性。
使用 Nano Banana 2 Edit 进行提示词驱动的图像编辑,支持多图输入,并可控制宽高比、分辨率、安全容忍度和输出选项。
根据文字指令编辑 1–10 张参考图片,并选择固定尺寸预设、随机种子以及 JPEG 或 PNG 输出。
根据文字生成图片,提供 6 个精确尺寸预设,并可设置推理步数、引导强度、随机种子以及 JPEG、PNG 或 WebP 输出。
针对活动艺术作品和精美产品视觉效果进行精确的参考图像编辑。
根据文字生成图片,可叠加最多 3 个 LoRA,并调整尺寸、权重和随机种子。
它会根据必填的 prompt,使用 image_urls 中的一张源图像创建下一场景的编辑图像。
prompt 和 image_urls 均为必填项。
image_urls 必须且只能包含一个可直接访问的图像 URL。
image_size 支持 square_hd、square、portrait_4_3、portrait_16_9、landscape_4_3 和 landscape_16_9,默认值为 landscape_16_9。
num_inference_steps 接受 2–50 的整数,默认值为 28。guidance_scale 接受 0–20,默认值为 6;数值越高,结果越贴近 prompt。
num_images 接受 1–4 的整数,默认值为 4。output_format 支持 jpeg 和 png,默认值为 png。
seed 是整数,默认值为 4571632。输入和其他设置不变时重复使用相同随机种子,有助于复现相同的请求条件。
negative_prompt 为可选项,可描述希望避开的内容,默认留空。
确认已填写 prompt,image_urls 只包含一个可访问 URL,image_size 属于六个可选值之一,num_inference_steps 为 2–50,guidance_scale 为 0–20,num_images 为 1–4,并且 output_format 为 jpeg 或 png。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。