ComfyUI>工作流程>Qwen Image 2.1 ComfyUI 工作流程:文本轉圖像

Qwen Image 2.1 ComfyUI 工作流程:文本轉圖像

Workflow Name: RunComfy/Qwen-Image-2.1-text-to-image
Workflow ID: 0000...1519
使用 Qwen Image 2.1 將您的提示轉換為詳細的 2048x2048 圖像。您可以塑造時尚人像、電影場景和產品概念。輕鬆調整提示和解析度。重用種子以獲得一致的結果。運行 INT8 以高效生成。將完成的藝術作品導出為 RGBA PNG 文件。

Qwen Image 2.1 Text To Image ComfyUI Workflow Workflow

Qwen Image 2.1 in ComfyUI | 2K INT8 Text-to-Image
想要運行這個工作流程嗎?
  • 完全可操作的工作流程
  • 沒有缺失的節點或模型
  • 無需手動設置
  • 具有驚豔的視覺效果

Qwen Image 2.1 Text To Image ComfyUI Workflow Examples

qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_01.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_02.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_03.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_04.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_05.webp
qwen-image-2-1-in-comfyui-2k-int8-text-to-image-1519-example_06.webp

Qwen Image 2.1 文本轉圖像 ComfyUI 工作流程#

使用官方 Qwen-Image-2.1 開放權重包裝的 ComfyUI 將文本提示轉換為詳細的高解析度圖像。此 Qwen Image 2.1 文本轉圖像 ComfyUI 工作流程專為希望獲得可重現結果和清晰輸出的創作者設計,支持原生 2048×2048 的 INT8 推論以高效利用 VRAM,並保存乾淨的 RGBA PNG,適合時尚人像、電影靜畫和精緻的產品概念。

圍繞簡單的生成–解碼–保存路徑構建,工作流程讓您可以直接控制提示文本、種子和解析度。保持固定種子以進行版本化迭代,通過提示措辭切換風格,並導出設計管道準備好的透明背景資產。

Comfyui Qwen Image 2.1 文本轉圖像 ComfyUI 工作流程中的關鍵模型#

  • Qwen-Image-2.1 (Comfy-Org):核心開放權重文本轉圖像模型,解釋您的提示並在潛在空間中合成圖像。它使用優化的 MMDiT 生成器以獲得高保真細節和字體感知的構圖。 Comfy-Org/Qwen-Image-2.1
  • Qwen-Image-2.1 VAE:自動編碼器將生成的潛在變量解碼回像素。它在高解析度下保持細節和色調一致性。與上述相同的模型包一起分發。
  • 官方範本(參考):權威的文本轉圖像圖形,您可以比較或根據需要進行調整。 image_qwen_image_2_1_t2i.json

如何使用 Comfyui Qwen Image 2.1 文本轉圖像 ComfyUI 工作流程#

整體流程:提示和種子條件化模型,採樣器在潛在空間中生成圖像,VAE 解碼為像素,輸出保存為 RGBA PNG。組從左到右運行,以便您可以快速預覽和迭代。

提示和風格

  • 使用正面提示進行意圖和藝術指導,使用負面提示防止產生瑕疵。對於時尚人像,參考照明、攝影角度、鏡頭和材料;對於電影畫面,指導情緒和色彩分級;對於產品拍攝,指定表面、工作室照明和反射。當您需要在提示微調中保持嚴格的可重現性時,保持穩定的種子。

解析度和種子

  • 在採樣前於解析度節點中設置目標大小。工作流程在 2048×2048 使用 INT8 權重和批量大小 1 進行現代 GPU 上的可靠驗證。如果您需要更快的預覽,請降至 1024 或 1536,然後返回至 2048 進行最終渲染。種子是用戶暴露的,因此您可以鎖定變化或隨機探索。

模型加載

  • 模型組加載 Qwen-Image-2.1 INT8 權重和伴隨的 VAE。除了選擇正確的檢查點外,無需手動連接。提示被編碼並傳遞給生成器,因此採樣器擁有所需的文本條件和潛在畫布。

採樣

  • KSampler 階段處理擴散軌跡。步驟和 CFG 被公開,因此您可以在速度和提示遵從性之間取得平衡。包含採樣器和調度器選擇以控制風格和穩定性;從默認值開始,然後僅在需要不同外觀或更嚴格的提示遵從時進行調整。

解碼和保存

  • VAE 將最終潛在變量解碼為圖像,保存組將其寫入 RGBA PNG。如果您的構圖假設透明度(標誌、UI 覆蓋、產品剪影),導出器將保留 alpha 通道,因此資產可以直接進入設計工具而無需額外遮罩。

Comfyui Qwen Image 2.1 文本轉圖像 ComfyUI 工作流程中的關鍵節點#

  • UNETLoader 加載實際執行生成的 Qwen-Image-2.1 INT8 擴散骨幹。保持指向 2.1 權重以在會話間保持一致性;僅在基準測試變體時切換。
  • CLIPLoader 或特定模型文本編碼器加載器 初始化提示編碼器,使您的文本正確嵌入到生成器中。如果更改編碼器,稍微調整 CFG 並重新檢查提示措辭以保持相同的視覺意圖。
  • EmptySD3LatentImage 定義潛在畫布大小和批次。在此處設置寬度和高度為 2048 × 2048 以獲得最終效果,然後向下調整以獲得更快的草稿。在原生解析度下保持批量大小 1 以避免 VRAM 壓力。
  • KSampler 驅動擴散過程。使用步驟來在速度和細節之間進行交易,調整 cfg 以緊縮或放鬆提示遵從性。如果切換採樣器或調度器,請進行小幅、漸進的更改,並在固定種子下比較結果。
  • SaveImage 將解碼後的圖像導出為具命名模式的 RGBA PNG。這保留了合成的透明度,並確保在與固定種子和提示結合時的精確可重現性。

可選附加功能#

  • 有效的提示模式:“35mm 時尚人像,柔光邊框,編輯風格,面料質感細節,中性背景”或“電影寬幅拍攝,光線通過百葉窗,青橙色調,高對比度”或“工作室產品渲染,光澤陶瓷杯,三點照明,無縫紙上的柔和陰影。”
  • 可重現性:每次導出時記錄提示、負面提示、種子和解析度。針對固定種子的微小編輯是調整外觀的最快方法而不失去構圖。
  • 性能:INT8 權重減少 VRAM 使用,使 2048×2048 成為可能。對於低內存硬件,預覽在 1024,滿意時再升級或重新渲染為全尺寸。
  • 參考構建:如果您想比較節點結構或恢復默認設置,從官方範本開始並遷移您的提示和保存節點。 image_qwen_image_2_1_t2i.json
  • 模型包:使用維護的 Comfy-Org 發行版以在不同環境中保持行為一致性。 Comfy-Org/Qwen-Image-2.1

致謝#

此工作流程實現並建立在以下作品和資源之上。我們誠摯地感謝 Comfy.org 的 ComfyUI 發布文章,Comfy-Org 的 Qwen-Image-2.1 開放權重,以及 Comfy-Org 的官方文本轉圖像工作流程範本,感謝他們的貢獻和維護。欲了解權威詳情,請參閱下方鏈接的原始文檔和存儲庫。

資源#

注意:所引用的模型、數據集和代碼的使用需遵循其作者和維護者提供的相應許可和條款。

RunComfy
版權 2026 RunComfy. 保留所有權利。

RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。