logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Z Image Turbo ControlNet:支持 LoRA 的结构引导图片到图片生成 | RunComfy

tongyi-mai/z-image/turbo/controlnet/lora

使用输入图片引导生成,并可设置 4 种预处理模式、0–1 控制时段、最多 3 个 LoRA 及 1–8 个推理步。

ControlNet 输入图片的 URL。
LoRA 列表 #1
LoRA 权重的 URL 或 Hugging Face 仓库 ID(owner/repo)。
LoRA 模型的应用强度。
要应用的 LoRA 列表,最多 3 项。
输出图片的尺寸预设。
ControlNet 条件影响结果的强度。
ControlNet 条件在生成过程中的开始位置。
ControlNet 条件在生成过程中的结束位置。
对 ControlNet 输入图片应用的预处理方式。
生成时使用的推理步数。
用于改变或复现结果的随机种子。
启用时自动扩展提示词。
生成文件的输出格式。
Idle
The rate is $0.01 per image.

Z Image Turbo ControlNet 简介

Z Image Turbo ControlNet 使用输入图片引导结构,并通过文字提示词描述目标结果。你可以选择 `none`、`canny`、`depth` 或 `pose` 预处理,调整控制强度及开始、结束位置,并应用最多 3 个 LoRA。页面还提供 7 种图片尺寸、1–8 个推理步、随机种子、提示词扩展以及 JPEG、PNG 或 WebP 输出。
适用场景:边缘引导的重设计 | 深度感知构图 | 姿态引导的角色变体

Z Image Turbo ControlNet 关于 X:见解和更新

模型概览#


  • 任务: ControlNet 引导的图片到图片生成
  • 简介: Z Image Turbo ControlNet 将提示词与一张控制图片结合。预处理方式决定提取何种结构信号,控制参数决定该信号的作用时段和强度,可选 LoRA 则用于添加模型或风格影响。

输入参数#


参数类型默认值/范围说明
promptstring必填对目标图片的描述。
image_urlstring (image_uri)必填ControlNet 输入图片的 URL。
lorasarray0–3 项; 必填; 默认 1 项要应用的 LoRA 列表,每项包含 path 和 scale。
image_sizestringsquare_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9, auto; 默认 auto输出尺寸预设。
control_scalefloat0–1; 默认 0.9ControlNet 条件的影响强度。
control_startfloat0–1; 默认 0控制条件在生成过程中的开始位置。
control_endfloat0–1; 默认 0.4控制条件在生成过程中的结束位置。
preprocessstringnone, canny, depth, pose; 默认 none对控制图片应用的预处理方式。
num_inference_stepsinteger1–8; 默认 8推理步数。
seedinteger默认 0用于改变或复现结果的随机种子。
enable_prompt_expansionboolean默认 false启用时自动扩展提示词。
output_formatstringjpeg, png, webp; 默认 png返回图片的文件格式。

每个 LoRA 项包含 path 和 scale;LoRA 的 scale 支持 0–4,默认值为 1。


使用建议#


  • 根据需要保留的结构选择预处理方式:canny 提取边缘,depth 保留空间布局,pose 提取人体关键点;如果控制图已经处理好,可选择 none。
  • 从默认控制设置开始,每次只修改 control_scale、control_start 或 control_end 中的一项。
  • 控制时段数值应保持在 0–1,并测试开始与结束位置的配合效果。
  • 仅添加目标结果真正需要的 LoRA,并谨慎调整各自强度。
  • 交付前请检查结构、裁切、人脸、手部、文字和风格一致性。

相关模型#


  • 不需要结构控制时,可使用 Z Image Turbo LoRA。
  • 如需不使用控制图片直接生成,可使用 Z Image Turbo Text to Image。

相关模型

z-image/turbo/text-to-image

根据提示词生成 1–4 张图片,并可选择宽高比、推理步数、随机种子和文件格式。

nano-banana/pro/text-to-image

根据提示词生成 1–4 张图片,并设置宽高比、分辨率、格式和返回方式。

imagen-4/ultra/text-to-image

使用 Imagen 4 Ultra 根据提示词生成图像,并设置负面提示词、宽高比和随机种子。

gpt-4o-image/edit

根据提示词编辑图像,可选使用遮罩,并设置宽高比。

flux-2/turbo/text-to-image

Flux 2 Turbo Text to Image 可根据文字快速生成高质量图像,并控制提示词遵循度、随机种子、宽高比和输出格式。

qwen-image/text-to-image

精准中文渲染与多语种图像编辑,助力创意设计

常见问题

Z Image Turbo ControlNet 的结果能否商用?

商用取决于当前模型、LoRA 与 RunComfy 条款,也取决于你是否拥有输入图片、提示词和结果素材的相应权利。正式使用前,请核对所有适用许可。

此页面有哪些结构控制参数?

preprocess 可选 none、canny、depth 或 pose。control_scale、control_start、control_end 均支持 0–1,用于控制条件的强度和作用时段。

支持多少个推理步和哪些输出格式?

num_inference_steps 支持 1–8,默认值为 8。output_format 支持 jpeg、png、webp,默认值为 png。

怎样使用 LoRA 自定义结果?

loras 最多接受 3 项。每项包含 path 和 0–4 的 scale,scale 默认值为 1。请仅使用你已检查许可和效果的 LoRA。

此工作流需要多少费用?

价格和促销活动没有写入此内容 schema,且可能变化。提交请求前,请查看 RunComfy 当前显示的积分费用。

寻求支持时应提供哪些信息?

请记录提示词、预处理方式、控制参数、LoRA 路径与强度、图片尺寸预设、推理步数、随机种子和输出格式。分享诊断信息前,请移除私密输入 URL 或凭据。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
图像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。