Alibaba Qwen выпустила новую модель Qwen-Image-2.1, предназначенную для генерации и редактирования изображений. Эта модель включает 7 миллиардов параметров, распределённых по 32 слоям единого диффузионного трансформера, и предлагает функции текстового ввода, редактирования с несколькими ссылками и локальных изменений.
Ранее выпущенная модель Qwen-Image в августе 2025 года имела 20 миллиардов параметров и использовалась отдельно для генерации и редактирования изображений. Qwen-Image-2.1 объединяет эти функции в одном решении, что делает её более компактной и эффективной. Для коммерческого использования требуется отдельная лицензия, однако модель доступна для исследования и оценки.
Данная модель представляет собой значительный шаг вперёд в области генерации изображений, предлагая баланс между производительностью и стоимостью. Qwen-Image-2.1 может быть использована в различных приложениях, что расширяет возможности для разработчиков и исследователей в области искусственного интеллекта.