Qwen-Image-2.1 объединяет генерацию и редактирование изображений в модели на 7B параметров
Qwen-Image-2.1: Compact, efficient, and unified image creation
Qwen-Image-2.1 — открытая модель, которая совмещает генерацию изображений по тексту и редактирование в одной архитектуре. Визуальный генератор содержит 7B параметров и 32 слоя Single-Stream DiT. Модель нативно создаёт и редактирует прозрачные изображения, принимает до 10 референсов, поддерживает локальные правки и сохраняет лица и товары. Смешанно-гранулярное внимание и переиспользование KV-кэша ускоряют вывод.
Qwen-Image-2.1 unifies text-to-image generation and image editing in a single model, with just 7B parameters in its visual generation component and native support for generating and editing transparent images.