Qwen Image 2.1 Edit ComfyUI ワークフロー: テキストからの正確な参照ガイド付き画像編集#
この Qwen Image 2.1 Edit ComfyUI ワークフローは、平易な言葉による指示と1つ以上の視覚的参照を忠実な画像編集に変換します。製品配置、照明と天候の変更、スタイル変換、画像内テキストの置換、キャラクターストーリーボード向けに設計されています。ワークフローは、元のシーン構成を保持しながら、要求された変更を適用するため、フレーミング、視点、背景がそのまま残ります。
統一された Qwen-Image-2.1 モデルを中心に構築されており、ベース画像をキャンバスとして受け入れ、プロンプトで呼び出すことができるオプションの参照画像を追加できます。典型的な例には、部屋に製品を追加すること、晴れのショットを雨に変換すること、ラベルを新しいテキストに置き換えること、キャラクターをパネル間で一貫して運ぶことが含まれます。結果は共有可能な画像としてエクスポートされます。
Comfyui Qwen Image 2.1 Edit ComfyUI ワークフローの主要モデル#
- Qwen-Image-2.1 拡散モデル (UNet)。指示と参照に一貫した変更を合成するコア画像エディター。このワークフローは、ComfyUI 用にパッケージ化された UNet 重みを使用し、公式の重みリポジトリ Comfy-Org/Qwen-Image-2.1 で利用可能です。
- Qwen3-VL 8B テキスト画像エンコーダー。指示プロンプトとリンクされた参照画像をコンディショニング信号にエンコードし、編集を駆動します。エンコーダーの重みは、Comfy-Org/Qwen-Image-2.1 のテキストエンコーダーの下に同じリポジトリで提供されています。
- Qwen-Image-2.1 VAE。拡散モデルが使用する潜在空間から画像を圧縮し、デコードします。高忠実度の再構成と安定した編集を保証するために、VAE の重みは Comfy-Org/Qwen-Image-2.1 に含まれています。
Comfyui Qwen Image 2.1 Edit ComfyUI ワークフローの使用方法#
全体のロジックは簡単です: モデルをロードし、キャンバスサイズを設定し、テキストと参照をエンコードし、編集をサンプリングし、結果を保存します。以下のグループはグラフの組織を反映しており、部品がどのように組み合わさるかを示しています。
モデルグループ#
このグループは、Qwen Image 2.1 Edit ComfyUI ワークフローを動かす UNet、マルチモーダルエンコーダー、VAE をロードします。UNet は編集能力を提供し、エンコーダーはプロンプトと参照画像をガイドに変換し、VAE はピクセルと潜在間を移動します。これらのローダーは、推奨される Qwen-Image-2.1 重みに事前に入力されているため、すぐに実行できます。高度なユーザーは、速度や精度のために同じファミリーの重みを交換できます。キャッシングが適用され、同じモデルで繰り返し実行しても再ロードのオーバーヘッドを回避します。
画像サイズグループ#
このグループは、編集が対象とする潜在キャンバスを決定します。デフォルトでは、キャンバスはベース画像のアスペクト比に従い、構成とカメラジオメトリを保持するのに役立ちます。カスタムキャンバスを有効にすると、ワークフローはユーザーが指定した幅と高さに切り替わり、スクエアサムネイルや縦方向のストーリーボードなどのタスクに対応します。最も忠実な編集を行うには、モデルが使用するリサイズされたベース画像に近いカスタムサイズを設定します。大きな逸脱は、編集を元のフレーミングから引き離す可能性があります。
コンディショニンググループ#
ここでワークフローはテキスト指示と視覚的コンテキストを融合させます。基本シーンを image_1 に接続し、任意の参照を追加の画像スロットに接続し、プロンプトで <image1>, <image2> などのトークンを使用してそれらを参照します。エンコーダーは、基本画像によって情報を得た初期潜在とともに、ポジティブおよびネガティブコンディショニングを構築し、編集を構成に固定します。明確で具体的なプロンプトが最適です: 変更するもの、保持するもの、視点、照明、または素材を一致させる方法を説明します。「余計なオブジェクトなし」や「テキストなし」などの制約を含めることもできます。
サンプリンググループ#
このグループはコンディショニングから実際の編集を生成します。サンプラーはステップ、ガイダンス強度、サンプラーまたはスケジューラーの選択を解釈し、忠実さと創造性のバランスを取ります。低いガイダンス値は入力を保持し、高い値は強い変更を推進します。中程度のステップ数でクリーンな結果が得られることがよくあります。サンプリング後、VAE は潜在を画像にデコードし、出力を保存します。厳密な再現性が必要な場合は固定されたシードを使用し、バリエーションを求める場合はランダム化します。
Comfyui Qwen Image 2.1 Edit ComfyUI ワークフローの主要ノード#
Image Edit (Qwen Image 2.1) (#459) これはワークフローをまとめるフロントパネルです。指示フィールド、サンプラーコントロール、カスタムサイズトグル、基本シーンと参照の画像入力を公開します。プロンプト内で <image1>, <image2> などを使用して、指示を接続された画像に明示的にバインドします。ネガティブプロンプトは、望まないもの(例: ロゴ、ウォーターマーク、余計なオブジェクト)に焦点を当ててください。この構造は、Qwen-Image-2.1 の公式編集テンプレートを反映しているため、ほとんどのタスクはグラフの変更なしで動作します reference。
TextEncodeQwenImage21 (#474) Qwen3-VL 8B エンコーダーでテキストと画像をエンコードし、基本画像に導かれたコンディショニングと初期潜在を準備します。ここでワークフローは、保持すべき要素と変更すべき要素を学習します。視点、素材、照明の点でターゲット結果に視覚的に近い参照を保持します。複数の参照を与える場合は、それらの役割をプロンプトで明確にして曖昧さを避けてください。ノードは、Comfy-Org/Qwen-Image-2.1 にバンドルされた公式 Qwen-Image-2.1 エンコーダーを使用します。
ResolutionSelector (#13) 便利なプリセットとカスタムキャンバス用の手動幅と高さを提供します。プロジェクトが特定のアスペクト比やピクセルサイズを要求する場合に使用します。ベース画像に最大限の忠実度を持たせるために、モデルの内部リサイズに近いカスタムサイズを保持します。Qwen-Image-2.1 は直接 2K 出力もサポートしており、ポストアップサンプリングなしでより高い詳細が必要な場合に使用します。詳細は Comfy-Org 重みページに記載されています reference。
ComfySwitchNode (#468) サンプラーが基本画像から派生した潜在を受け取るか、セレクターによってサイズが指定された空のキャンバスから受け取るかを制御します。厳密なカスタム寸法の場合はオンにし、基本画像のジオメトリを自動的に追従する場合はオフにします。カスタムキャンバスを選択する場合は、基本画像のリサイズされた寸法からの極端な逸脱を避けてください。編集がずれる可能性があります。このシンプルなスイッチは、構成を保持する編集と意図的な再構成の間を動かす鍵です。
KSampler (#458) 編集を生成する拡散プロセスを実行します。steps は詳細と安定性を調整し、cfg はプロンプトが結果をどれだけ強く導くかを調整します。低いガイダンスは入力の保持に寄与し、高いガイダンスは大きな変更を強制します。sampler_name と scheduler はテクスチャと収束に影響を与えます。提供された組み合わせは Qwen-Image-2.1 の実用的なデフォルトです。seed を固定して結果を再現するか、バリエーションを求める場合はランダム化します。変更がほぼ正しいが完璧でない場合は、プロンプトを書き換える前に小さなステップやガイダンスの調整を試してください。
SaveImageAdvanced (#461) ファイル名のプレフィックス、形式、カラースペースを処理し、出力が整理されて共有準備が整います。タスクまたはショットごとに明確で意味のあるプレフィックスを使用して、複数回の実験を整然と保ちます。反復中には、プレフィックスにシーンや主題などのキー実行情報を埋め込んで、後で迅速にフィルタリングできるように検討してください。PNG は安全なアーカイブ選択です。ファイルサイズが重要である場合のみ JPEG に切り替えてください。
オプションの追加#
- 製品配置用のプロンプトパターン: "<image1> を基本シーンとして使用します。<image2> の[オブジェクト]を[表面]に配置します。[照明]と[視点]を一致させます。柔らかい接触影を追加します。余計なオブジェクトなし、テキストなし。"
- 照明や天候の変更の場合、保持するものを述べる: "<image1> から構成とカメラフレーミングを保持します。ゴールデンアワーの太陽光/小雨/曇りに変換し、既存の影を一致させます。"
- スタイル変換の場合、素材やレンダーの変更を要求し、構造を保持する: "<image1> からレイアウトを保持します。水彩画のイラスト/シネマティックグレード/ネオンサイバーパンクのカラーパレットに変換します。"
- 画像内テキストの置換の場合、明確にする: "<image1> のラベルを『NEW TEXT』に置き換え、同じフォントの太さと色を保持し、エッジと反射を保持します。"
- キャラクターストーリーボードの場合、<image2>..<imageN> にわたる複数の顔や衣装の参照を提供し、パネル間でのアイデンティティの一貫性を要求します。
この Qwen Image 2.1 Edit ComfyUI ワークフローは、正確な言語と具体的な視覚的手がかりに応じる効率的な構成認識エディターを提供します。明確なプロンプト、良い参照、および基本画像を尊重するサイズ選択から始め、小さなサンプラ調整で反復してプロダクション準備が整った結果を得てください。
謝辞#
このワークフローは、以下の作品やリソースを実装し、基にしています。Comfy-Org に ComfyUI ワークフローソースと公式の画像編集テンプレート、Qwen に Qwen-Image-2.1 モデルとアナウンスメント、Comfy-Org に ComfyUI モデルの重みをホスティングしていただき、貢献と維持に感謝します。詳細については、以下にリンクされたオリジナルのドキュメントとリポジトリを参照してください。
リソース#
- Comfy-Org/Workflow source
- ドキュメント / リリースノート: Workflow source
- Qwen/Qwen Image 2.1 アナウンスメント
- ドキュメント / リリースノート: Qwen Image 2.1 アナウンスメント
- Comfy-Org/ComfyUI model weights
- Hugging Face: Comfy-Org/Qwen-Image-2.1
- Comfy-Org/Official image editing template
- GitHub: Comfy-Org/workflow_templates
注: 参照されたモデル、データセット、およびコードの使用は、それぞれの著者および維持者が提供するライセンスと条件に従います。








