logo
RunComfy
  • ComfyUI
  • 訓練器新
  • 模型
  • API
  • 定價
discord logo
模型
探索
所有模型
資源庫
生成記錄
模型 API
API 文檔
API 金鑰
帳戶
使用情況

Qwen Image 2512:數秒生成高保真圖片 | RunComfy

qwen/qwen-image/qwen-image-2512

生成可直接用於製作的圖片,呈現真實材質、清晰中英文文字和經過最佳化的固定長寬比。

描述生成圖片中不應出現的內容。
執行圖片生成時使用的推論步數。
提示詞對圖片生成結果的引導強度。
生成圖片的檔案格式。
Idle
The rate is $0.02 per image.

Qwen Image 2512 簡介

阿里巴巴的 Qwen Image 2512 可將文字提示詞轉換為可直接用於製作的圖片,價格為每張 $0.02。模型提供針對畫質最佳化的固定長寬比,並擅長準確渲染中文和英文文字。它能減少手動字距調整、複雜遮罩和精細人像修飾等工作,加快電商、設計和行銷團隊從創意到交付的審核流程。開發者可在 RunComfy 瀏覽器介面中直接使用,也可透過 HTTP API 串接,無需自行部署或擴縮模型。

適合:多語言海報與簡報 | 寫實人像行銷活動 | 商品詳情頁設計

Alibaba / Qwen Image 2512#


Qwen Image 2512 是 RunComfy 提供的文生圖模型,可根據 prompt 和可選的 negative_prompt 生成一張高品質靜態圖片。它適合創意設計、行銷素材、含文字海報和寫實場景。


輸出格式: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9


核心亮點#


  • 中英文文字渲染:能更清晰地呈現多行中文和英文文字。
  • 人物真實感增強:減少塑膠感,改善臉部、頭髮和皮膚細節。
  • 版面還原穩定:更好地維持海報配置、網格和文字對齊。
  • 生成速度快:約 5 秒即可生成一張高品質圖片。

參數#


Parameter必填TypeDefaultRange / Options說明
prompt*是 (*)string——用於生成圖片的提示詞。
negative_prompt否string""—可選內容,用於減少或避免圖片中的指定元素。
image_size否ImageSizeEnum or objectlandscape_4_3Enum: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9.
num_inference_steps否integer28—推論步數;提高數值可能增加細節,但也會降低速度。
guidance_scale否float5—提示詞引導強度;中等數值通常能平衡準確度與創作空間。
seed否integer——固定隨機種子,可在相同設定下重現結果。
output_format否OutputFormatEnum"png"jpeg, png, webp結果圖片的檔案格式。

使用方法#


  1. 填寫 prompt:描述主體、環境、鏡頭視角、光線,以及需要出現在圖片中的文字。
  2. 加入 negative_prompt(可選):寫明需要避免的瑕疵、物體或風格。
  3. 選擇 image_size:根據構圖選擇合適的固定長寬比。
  4. 設定 num_inference_steps:建議從 28 開始;如細節不足,可小幅提高。
  5. 調整 guidance_scale:5 左右通常較均衡;若結果偏離 prompt,可適度提高。
  6. 固定 seed 進行比較:重複使用同一數值,比較提示詞或參數的細微改動。
  7. 選擇 output_format:PNG 適合無損圖形,JPEG 檔案較小,WEBP 兼顧品質與容量。
  8. 生成並檢查:查看結果,再透過小幅修改繼續迭代。

提示詞與參考建議#


  • 需要圖中文字時,請直接寫出準確內容,並用引號括起,讓模型將其視為文案而不是風格描述。
  • 加入版面要求,例如「標題位於左上角、說明文字位於底部」,幫助模型穩定放置元素。
  • 明確指定相機和鏡頭資訊,例如 50mm、淺景深或俯拍,以維持構圖一致。
  • 風格描述盡量簡短,例如「編輯風、霧面、柔和散射光」,避免重點分散。
  • 優先使用常見單位和顏色名稱,簡單明確的描述通常更可靠。
  • 固定 seed,比較 num_inference_steps 和 guidance_scale 的調整效果,避免隨機變化干擾。
  • 如出現輕微瑕疵,可在 negative_prompt 中加入「模糊、浮水印、多餘手指」等內容。

Qwen Image 2512 與其他模型的比較#


  • 根據社群回饋,與早期 Qwen-Image 版本相比,它的人像更自然,中英文文字更準確,生成速度也顯著提升。
  • 主要改進包括更自然的紋理細節、更準確的海報與簡報版面,以及無需過高 guidance_scale 也能穩定遵循 prompt。
  • 需要在同一流程中兼顧清晰圖中文字與寫實人像時,Qwen Image 2512 特別合適。
  • 與 Flux 2 相比,Qwen Image 2512 通常更擅長圖中文字清晰度和人物真實感;Flux 2 則提供更廣的風格範圍和更靈活的解析度。

其他推薦模型#


  • Qwen-Image-Edit-2511
  • Qwen-Image-Edit-2509

官方資源#


  • GitHub(Qwen 官方組織): https://github.com/QwenLM
  • Hugging Face(Qwen 官方組織): https://huggingface.co/Qwen

相關模型

gpt-4o-image/edit

依提示詞編輯圖像,可選使用遮罩,並設定長寬比。

z-image/turbo/controlnet/lora

根據一張控制圖片產生新圖,支援最多 3 個 LoRA、4 種預處理模式、分階段 ControlNet 控制及 1–8 個推理步。

gpt-4o-image/text-to-image

透過精細的提示詞控制,生成寫實且文字呈現準確的圖片。

qwen-image/qwen-image-edit-2511/lora

基於 LoRA 的圖片編輯模型,可在維持結構和主體一致性的同時精準修改創意素材。

flux-2/flash/edit

Flux 2 Flash Edit 可依照明確的文字指令編輯最多 4 張參考圖,並精確控制尺寸和輸出格式。

gemini-3-pro-image-preview/text-to-image

根據必填提示詞產生 1–4 張圖片,並可選擇 10 種長寬比、1K/2K/4K 解析度、三種檔案格式和同步傳回模式。

常見問題

如何從 RunComfy 模型頁面 測試過渡到使用 Qwen Image 2512 API 進行正式部署?

在 RunComfy 模型頁面 完成測試後,開發者可沿用相同的模型設定串接 RunComfy API。建立 API 金鑰後,即可透過程式設定生成參數並管理用量與成本;正式部署時還應確認 Qwen Image 2512 的 Apache 2.0 授權要求。

Qwen Image 2512 對圖片內多語言文字和排版的處理效果如何?

模型能夠較準確地呈現中文和英文文字,支援多行段落和中英文混排海報。它具備版面理解能力,即使面對複雜設計,也能更好地維持文字對齊並減少變形。

為什麼 Qwen Image 2512 適合人物肖像和文字較多的場景?

它能細緻呈現不同膚色、頭髮紋理、人物姿勢,同時維持圖片內文字清晰可讀,因此適合同時追求寫實人物與準確排版的雜誌封面、廣告和資訊圖表。

在文字渲染和真實感方面,Qwen Image 2512 與 Nano Banana Pro 或 Flux 2 有何不同?

部分模型更著重寫實風格或 4K 輸出,而 Qwen Image 2512 強調準確文字、自然紋理與生成速度之間的平衡。相關基準結果顯示,它在中英文內容的版面對齊方面優於同類開源方案。

哪些專案最適合整合 Qwen Image 2512?

它適合需要製作高品質多語言資訊圖表、海報和廣告素材的創意機構、教育團隊與出版商。模型兼具專業級真實感和生成彈性,可用於早期原型,也可用於規模化製作。

關注我們
  • 領英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 電子郵件
  • 系統狀態
  • 附屬
視頻模型
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • 查看所有模型 →
影像模型
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • 查看所有模型 →
法律
  • 服務條款
  • 隱私政策
  • Cookie 政策
RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。

Qwen Image 2512 效果範例