Qwen-Image-2.1 вышла в открытый доступ: нейросеть на 7 млрд параметров генерирует картинки в 2K и работает локально

20 сентября 2026 года команда Qwen выложила в открытый доступ диффузионную модель Qwen-Image-2.1, предназначенную для генерации и комплексного редактирования изображений. Ее визуальный блок насчитывает 7 миллиардов параметров и поддерживает нативное разрешение вплоть до 2K при одновременной обработке текста и картинок. Для энтузиастов локального ИИ это значимый релиз: модель решает сразу несколько давних проблем открытых генераторов и практически сразу получила оптимизированные сборки для запуска на потребительских видеокартах.
Новая архитектура оптимизирована для глубокой интеграции в рабочие пайплайны. Модель умеет создавать изображения с прозрачным фоном в формате RGBA без необходимости последующего ручного вырезания, редактировать выбранные области по маске и изолировать отдельные объекты с фотографий.
Кроме того, система поддерживает передачу до десяти референсных изображений одновременно, что упрощает сохранение единого стиля или внешности персонажа между генерациями. Как указано на странице репозитория на Hugging Face, разработчики существенно улучшили отрисовку типографики и сложного текста внутри кадра, анатомию лиц, мелкие текстуры и сложные сценарии сценического освещения.
Облегченные GGUF-сборки и ComfyUI
Экосистема вокруг релиза сформировалась буквально за считанные дни. Исходные веса опубликованы под лицензией Qwen Research License и поддерживаются библиотеками Diffusers, vLLM-Omni и SGLang, о чем сообщается в документации на GitHub.
Для владельцев домашних ПК независимые энтузиасты уже подготовили квантованные сборки в формате GGUF для популярного интерфейса ComfyUI. В частности, в репозитории abenzerps на Hugging Face доступны версии размером от 4,05 до 7,59 ГБ. Наиболее сбалансированным по скорости и качеству автор называет вариант Q4_K_M весом 4,6 ГБ. Для полноценного локального запуска пользователю также понадобятся текстовый энкодер и модуль VAE.
Got early access to the upcoming Qwen-image 2.1!
— Hakm (@hakmgpt) September 19, 2026
Here are a few images generated with the model , check out the comment section for the full quality. pic.twitter.com/PfEXECyIOR
Что на самом деле означает статус «без цензуры»
Вокруг локальных сборок быстро возник ажиотаж из-за отсутствия жестких ограничений контента. Энтузиасты выяснили, что в автономном пайплайне модель свободно выполняет чувствительные промпты, создавая в том числе сцены насилия и NSFW-материалы.
Однако этот факт связан исключительно с отсутствием внешней программной надстройки (safety checker) и стоп-листов, которые обычно встраивают в облачные веб-интерфейсы. Сама команда Qwen не объявляла модель «нейросетью без цензуры». Появившаяся на платформе отдельная страница Qwen-Image-2.1-Uncensored-GGUF использует стандартные исходные веса модели без дополнительного дообучения или снятия ограничений на уровне архитектуры.