Появилась новая модель редактирования изображений с открытым исходным кодом. Qwen-Image-2.1 теперь поддерживается в ComfyUI нативно. Открытые веса, 7 миллиардов параметров и генерация реального альфа-канала.
Qwen-Image 2.1 — новейшая модель изображений от команды Qwen компании Alibaba. Она работает на 7 миллиардах параметров в рамках оптимизированной архитектуры MMDiT — того же класса, что и Qwen-Image 2.0, выпущенная в феврале 2026 года с нативным выводом 2K, изображениями с прозрачностью, высококачественным рендерингом текста и возможностями редактирования, позволяющими использовать до 10 входящих изображений одновременно. При размере 7B инференс происходит быстро, а веса легко помещаются на потребительских видеокартах.
- Вывод RGBA. Четыре канала, включая альфа-канал. Спрайты, логотипы, иконки и вырезанные изображения продуктов выходят из сэмплера готовыми к компоновке. Никаких нод удаления фона, моделей матовости и очистки краев. Ни одна другая крупная открытая модель этого не делает.
Вывод RGBA. Четыре канала, включая альфа-канал. Спрайты, логотипы, иконки и вырезанные изображения продуктов выходят из сэмплера готовыми к компоновке. Никаких нод удаления фона, моделей матовости и очистки краев. Ни одна другая крупная открытая модель этого не делает.
- Нативная генерация 2K. Прямой вывод в разрешении 2048×2048. Создается сразу в таком разрешении, без апскейла.
Нативная генерация 2K. Прямой вывод в разрешении 2048×2048. Создается сразу в таком разрешении, без апскейла.
- До 10 референсных изображений. Нода Text Encode Qwen Image 2.1 открывает входы для изображений по мере их заполнения, вплоть до 10. Персонаж, продукт, фоновая пластина, референс стиля — все они считываются текстовым кодировщиком и встраиваются в последовательность в виде латентных представлений VAE.
До 10 референсных изображений. Нода Text Encode Qwen Image 2.1 открывает входы для изображений по мере их заполнения, вплоть до 10. Персонаж, продукт, фоновая пластина, референс стиля — все они считываются текстовым кодировщиком и встраиваются в последовательность в виде латентных представлений VAE.
- Один чекпоинт. Генерация и редактирование в одной модели.
Один чекпоинт. Генерация и редактирование в одной модели.
- 7 миллиардов параметров. Быстрый инференс, низкие затраты, потребительская видеопамять (VRAM).
7 миллиардов параметров. Быстрый инференс, низкие затраты, потребительская видеопамять (VRAM).
- Обновите ComfyUI до последней версии или откройте Comfy Cloud.
Обновите ComfyUI до последней версии или откройте Comfy Cloud.
- Скачайте веса Qwen-Image-2.1 с Hugging Face и поместите их в папку models.
Скачайте веса Qwen-Image-2.1 с Hugging Face и поместите их в папку models.
- Загрузите шаблон Qwen-Image-2.1 из панели шаблонов или скачайте воркфлоу здесь.
Загрузите шаблон Qwen-Image-2.1 из панели шаблонов или скачайте воркфлоу здесь.
- Напишите промпт, прикрепите референсные изображения к image_1 и далее, после чего запустите процесс.
Напишите промпт, прикрепите референсные изображения к image_1 и далее, после чего запустите процесс.
Попробуйте в Comfy Cloud и расскажите нам, что у вас получилось. Как всегда, желаем приятного творчества!
Нет записей








