Рабочий процесс Qwen Image 2.1 Edit ComfyUI: точное, управляемое ссылками редактирование изображений на основе текста#
Этот рабочий процесс Qwen Image 2.1 Edit ComfyUI превращает инструкции на простом языке и одну или несколько визуальных ссылок в достоверные изменения изображений. Он предназначен для размещения продуктов, изменения освещения и погоды, преобразования стиля, замены текста на изображении и раскадровок персонажей. Рабочий процесс сохраняет оригинальную композицию сцены при применении запрашиваемых изменений, так что ваше кадрирование, перспектива и фон остаются нетронутыми.
Созданный на основе унифицированной модели Qwen-Image-2.1, конвейер принимает базовое изображение в качестве холста плюс дополнительные ссылочные изображения, которые вы можете вызвать в своей подсказке. Типичные примеры включают добавление продукта в комнату, преобразование солнечного снимка в дождь, замену этикетки новым текстом или поддержание персонажа последовательно через панели. Результаты экспортируются как готовые к обмену изображения.
Ключевые модели в Comfyui Qwen Image 2.1 Edit ComfyUI Workflow#
- Модель диффузии Qwen-Image-2.1 (UNet). Основной редактор изображений, который синтезирует изменения в соответствии с вашими инструкциями и ссылками. Этот рабочий процесс использует веса UNet, упакованные для ComfyUI, доступные в официальном репозитории весов Comfy-Org/Qwen-Image-2.1.
- Кодировщик текст-изображение Qwen3-VL 8B. Кодирует инструкцию и связанные ссылочные изображения в сигналы кондиционирования, которые управляют редактированием. Веса кодировщика поставляются с тем же репозиторием под text_encoders в Comfy-Org/Qwen-Image-2.1.
- Qwen-Image-2.1 VAE. Сжимает и декодирует изображения в и из латентного пространства, используемого моделью диффузии, обеспечивая высокую точность реконструкции и стабильные изменения. Веса VAE включены в Comfy-Org/Qwen-Image-2.1.
Как использовать Comfyui Qwen Image 2.1 Edit ComfyUI Workflow#
Общая логика проста: загрузите модели, установите размер холста, закодируйте ваш текст и ссылки, выполните редактирование и сохраните результат. Группы ниже отражают организацию графа и показывают, как части сочетаются друг с другом.
Группа моделей#
Эта группа загружает UNet, мультимодальный кодировщик и VAE, которые питают рабочий процесс Qwen Image 2.1 Edit ComfyUI. UNet предоставляет возможность редактирования, кодировщик превращает вашу подсказку и ссылочные изображения в руководство, а VAE перемещается между пикселями и латентами. Эти загрузчики заполнены рекомендованными весами Qwen-Image-2.1, чтобы вы могли работать "из коробки". Опытные пользователи могут менять веса той же семьи для скорости или точности. Применяется кэширование, чтобы повторные запуски с той же моделью избегали накладных затрат на перезагрузку.
Группа размера изображения#
Эта группа определяет латентный холст, на который будет нацелено редактирование. По умолчанию холст следует за соотношением сторон вашего базового изображения, чтобы помочь сохранить композицию и геометрию камеры. Если вы включите пользовательский холст, рабочий процесс переключится на ширину и высоту, заданные пользователем, для задач, таких как квадратные миниатюры или вертикальные раскадровки. Для наиболее точных изменений установите пользовательский размер, который близок к измененному базовому изображению, используемому моделью. Большие отклонения могут увести редактирование от оригинального кадрирования.
Группа кондиционирования#
Здесь рабочий процесс объединяет текстовые инструкции с визуальным контекстом. Подключите вашу базовую сцену к image_1 и любые ссылки к дополнительным слотам изображений, затем упомяните их в вашей подсказке с помощью таких токенов, как <image1>, <image2> и т. д. Кодировщик создает положительное и отрицательное кондиционирование плюс начальный латент, информированный базовым изображением, который привязывает редактирование к вашей композиции. Четкие, конкретные подсказки работают лучше всего: опишите, что изменить, что сохранить и как соответствовать перспективе, освещению или материалу. Вы можете включать ограничения, такие как "никаких дополнительных объектов" или "нет текста", чтобы подавить нежелательные артефакты.
Группа выборки#
Эта группа генерирует фактическое редактирование из кондиционирования. Семплер интерпретирует шаги, силу руководства и выбор семплера или планировщика, чтобы сбалансировать точность и креативность. Низкие значения руководства склоняются к сохранению входных данных, в то время как более высокие значения усиливают изменения; умеренное количество шагов часто достаточно для чистых результатов. После выборки VAE декодирует латент в изображение, и выход сохраняется. Если вам нужна строгая воспроизводимость, сохраните фиксированное семя; если вы хотите разнообразие, рандомизируйте его.
Ключевые узлы в Comfyui Qwen Image 2.1 Edit ComfyUI Workflow#
Image Edit (Qwen Image 2.1) (#459) Это передняя панель, которая связывает рабочий процесс вместе. Она раскрывает поля инструкций, элементы управления семплером, переключатель пользовательского размера и входы изображений для базовой сцены и ссылок. Используйте <image1>, <image2> и т. д. внутри вашей подсказки, чтобы явно привязать инструкции к подключенным изображениям. Держите отрицательную подсказку сосредоточенной на вещах, которых вы не хотите (например, "логотипы, водяные знаки, дополнительные объекты"). Структура отражает официальную шаблонную редакцию для Qwen-Image-2.1, так что большинство задач работает без изменений графа reference.
TextEncodeQwenImage21 (#474) Кодирует текст и изображения с помощью кодировщика Qwen3-VL 8B и подготавливает как кондиционирование, так и начальный латент, управляемый базовым изображением. Здесь рабочий процесс узнает, какие элементы сохранить и какие изменить. Держите ссылки визуально близкими к вашему целевому результату с точки зрения перспективы, материала и освещения. При предоставлении нескольких ссылок укажите их роли в подсказке, чтобы избежать двусмысленности. Узел использует официальные кодировщики Qwen-Image-2.1, упакованные в Comfy-Org/Qwen-Image-2.1.
ResolutionSelector (#13) Предоставляет удобные пресеты плюс ручную ширину и высоту для пользовательских холстов. Используйте его, когда проект требует определенного соотношения сторон или размера пикселей, таких как квадраты для рынка или высокие кадры раскадровки. Для максимальной точности к базовому изображению держите пользовательский размер близким к внутреннему изменению размера модели базового изображения. Qwen-Image-2.1 также поддерживает прямые 2K выходы; используйте это, когда вам требуется более высокая детализация без последующей интерполяции, как описано на странице весов Comfy-Org reference.
ComfySwitchNode (#468) Управляет тем, получает ли семплер латент, полученный из вашего базового изображения, или из пустого холста, размером которого управляет селектор. Включите его для строгих пользовательских размеров или выключите, чтобы автоматически следовать геометрии базового изображения. Если вы выберете пользовательский холст, избегайте крайних отклонений от измененных размеров базового изображения, иначе редактирование может отклониться. Этот простой переключатель является ключом к переходу между сохранением композиции и преднамеренной перекомпоновкой.
KSampler (#458) Запускает процесс диффузии, который производит редактирование. Регулируйте steps для детализации и стабильности и cfg для того, насколько сильно подсказка направляет результат; более низкое руководство, как правило, лучше сохраняет входные данные, в то время как более высокое руководство обеспечивает более значительные изменения. sampler_name и scheduler влияют на текстуру и сходимость; предоставленные комбинации являются практическими по умолчанию для Qwen-Image-2.1. Фиксируйте seed, чтобы воспроизвести результат, или рандомизируйте его для новых вариаций. Когда изменение почти правильно, но не идеально, попробуйте небольшие изменения шагов или руководства, прежде чем переписывать подсказку.
SaveImageAdvanced (#461) Обрабатывает префикс имени файла, формат и цветовое пространство, чтобы выходы были организованы и готовы к обмену. Используйте четкие, семантические префиксы для каждой задачи или снимка, чтобы поддерживать порядок в экспериментах с несколькими запусками. При итерации рассмотрите возможность встраивания ключевой информации о запуске в префикс, например, сцены или объекта, для быстрой фильтрации позже. PNG является безопасным выбором для архивирования; переключитесь на JPEG только в случае, если размер файла критичен.
Дополнительные опции#
- Шаблон подсказки для размещения продуктов: "Используйте <image1> в качестве базовой сцены. Разместите [объект] из <image2> на [поверхности]. Соответствуйте [освещению] и [перспективе]. Добавьте мягкую контактную тень. Без дополнительных объектов, без текста."
- Для изменений освещения или погоды укажите, что сохранить: "Сохраните композицию и кадрирование камеры из <image1>. Преобразуйте в золотой час солнечного света / легкий дождь / пасмурную погоду, сохраняя существующие тени."
- Для преобразования стиля запросите изменения материала или рендеринга, сохраняя структуру: "Сохраняйте макет из <image1>. Преобразуйте в акварельную иллюстрацию / кинематографическую градацию / неоновую киберпанк палитру."
- Для замены текста на изображении будьте конкретны: "Замените этикетку на <image1> на ‘НОВЫЙ ТЕКСТ’, тот же вес шрифта и цвет, сохраните края и отражения."
- Для раскадровок персонажей предоставьте несколько ссылок на лица или наряды через <image2>..<imageN> и запросите последовательность идентичности от панели к панели.
Этот рабочий процесс Qwen Image 2.1 Edit ComfyUI предоставляет вам эффективный редактор, учитывающий композицию, который реагирует на точный язык и конкретные визуальные подсказки. Начните с четких подсказок, хороших ссылок и выбора размера, который уважает базовое изображение, затем повторяйте с небольшими изменениями семплера для получения готовых к производству результатов.
Благодарности#
Этот рабочий процесс реализует и строится на следующих работах и ресурсах. Мы искренне благодарим Comfy-Org за источник рабочего процесса ComfyUI и официальную шаблонную редакцию изображений, Qwen за модель Qwen-Image-2.1 и анонс, а также Comfy-Org за размещение весов модели ComfyUI за их вклад и поддержку. За авторитетными деталями, пожалуйста, обращайтесь к оригинальной документации и репозиториям, указанным ниже.
Ресурсы#
- Comfy-Org/Источник рабочего процесса
- Документация / Примечания к выпуску: Источник рабочего процесса
- Qwen/Анонс Qwen Image 2.1
- Документация / Примечания к выпуску: Анонс Qwen Image 2.1
- Comfy-Org/Веса модели ComfyUI
- Hugging Face: Comfy-Org/Qwen-Image-2.1
- Comfy-Org/Официальный шаблон редактирования изображений
- GitHub: Comfy-Org/workflow_templates
Примечание: использование упомянутых моделей, наборов данных и кода подчиняется соответствующим лицензиям и условиям, предоставленным их авторами и поддерживающими организациями.








