Qwen Image 2.1 Turbo: нейросеть Alibaba генерирует 2K-картинки в 5 раз быстрее за 1,3 рубля
Alibaba второго июня выпустила Qwen Image 2.1 Turbo, ускоренную версию своей модели для генерации и редактирования изображений, которая делает за 8 шагов то, на что базовой версии требовалось 40.
Qwen Image нейросеть генерирует картинки в 2K-разрешении в пять раз быстрее базовой модели и стоит 0,1 юаня за изображение через облачный API, что делает её одним из самых дешёвых вариантов для разработчиков и авторов, которым нужна массовая генерация визуала.
Модель выпустила команда Qwen, подразделение Alibaba. Qwen Image 2.1 Turbo построена на той же архитектуре с 7 миллиардами параметров, что и базовая Qwen Image 2.1, но использует дистиллированный (сжатый по числу вычислительных шагов) процесс генерации. Базовая модель набирает 60,28 балла на собственном бенчмарке Qwen-Image-Bench, это лучший результат среди моделей с открытыми весами (open weights, когда разработчик публикует параметры модели и её можно запускать на своём оборудовании), о котором сообщает Qwen. Отдельного бенчмарка именно для Turbo-версии пока нет.
| Что | Когда | Кто выпустил | Цена |
|---|---|---|---|
| Qwen Image 2.1 Turbo, ускоренная модель генерации и редактирования изображений | Июнь 2025 | Команда Qwen, Alibaba | 0,1 CNY (около 1,3 рубля) за изображение через облачный API |
Что умеет Qwen Image нейросеть нового поколения?
- 8 шагов вместо 40. Генерация изображения занимает в пять раз меньше вычислительных шагов. Качество и набор функций при этом заявлены на уровне базовой модели.
- Разрешение до 2K. Поддерживаются форматы от квадрата 2048 на 2048 до широкоформатного 2752 на 1536 (соотношение 16:9).
- Генерация и редактирование в одной модели. Один и тот же чекпоинт (файл с обученными параметрами) работает и как генератор картинок по текстовому промпту (prompt, текстовая инструкция для нейросети), и как редактор: можно подать до 10 референсных изображений, рисовать области редактирования кругами, заливкой или масками.
- Прозрачный фон (RGBA). Встроенный автоэнкодер (VAE) поддерживает альфа-канал, то есть модель умеет генерировать объекты на прозрачном фоне, без дополнительной обработки.
- Кэширование контекста. Текст и референсные изображения вычисляются один раз на первом шаге, а затем переиспользуются на остальных семи. Это экономит время и память видеокарты.
- Текстовый энкодер Qwen3-VL 8B. Мультимодальная (multimodal, работающая одновременно с текстом и изображениями) языковая модель на 8 миллиардов параметров кодирует и инструкции, и входные картинки.
Как попробовать?
- Через облачный API. Зарегистрируйтесь в Alibaba Cloud Model Studio. Turbo-версия доступна по тарифу 0,1 CNY за изображение с лимитом 120 запросов в минуту. Для сравнения: Pro-версия стоит 0,25 CNY за изображение с лимитом 20 запросов в минуту, то есть Turbo в 2,5 раза дешевле и допускает в шесть раз больше обращений.
- Локально на видеокарте. Модель запускается через библиотеку Diffusers из исходников, требуется версия transformers 5.17.0 или выше. Для базовой модели Qwen Image 2.1 сторонний проект Unsloth оценивает минимум в 11 ГБ видеопамяти (формат GGUF) или 24 ГБ (INT8/FP8). Для Turbo-версии Qwen минимальных требований не публикует.
- Скачать веса. Модель доступна на Hugging Face и ModelScope. Веса выложены под исследовательской лицензией: для коммерческого использования на своих серверах нужно отдельное разрешение от Alibaba.
Сравнение с доступными в России вариантами
Прямого аналога Qwen Image 2.1 Turbo среди российских сервисов пока нет: YandexGPT и GigaChat работают преимущественно с текстом. Генерация изображений у Сбера реализована через отдельный сервис Kandinsky, у Яндекса через YandexART.
| Параметр | Qwen Image 2.1 Turbo | Kandinsky (Сбер) | YandexART |
|---|---|---|---|
| Генерация по тексту | Да, до 2K | Да | Да |
| Редактирование по инструкции | Да, до 10 референсов | Ограниченно | Ограниченно |
| Прозрачный фон | Да (RGBA) | Нет | Нет |
| Открытые веса | Да (исследовательская лицензия) | Нет | Нет |
| Облачный API | Да, 0,1 CNY за картинку | Да, через GigaChat API | Через Яндекс Cloud |
Для авторов из России, которым нужна бюджетная генерация визуала через API, Qwen Image нейросеть остаётся одним из немногих открытых вариантов с полноценным редактированием.
Я протестировал предыдущие модели линейки Qwen Image, и качество генерации у них заметно выросло за последний год. Turbo-версия интересна не столько скоростью (восемь шагов против сорока заметны разработчику, а не конечному пользователю API), сколько ценой: 0,1 юаня за картинку, это порядка 1,3 рубля. Для автора Дзена, которому нужны обложки или иллюстрации к статьям, это копейки.
Но есть оговорки. Исследовательская лицензия означает, что вы не можете просто скачать веса и встроить модель в коммерческий продукт без разрешения Alibaba. API работает через Alibaba Cloud, а значит, возможны ограничения по доступу из России: проверяйте оплату и маршрутизацию.
Что сделать сегодня: попробуйте API через Alibaba Cloud Model Studio, сгенерируйте десяток обложек для своих статей и сравните с тем, что даёт Kandinsky или Midjourney. Если качество устраивает, переводите рутинную генерацию визуала на Qwen Image и экономьте бюджет.
Частые вопросы
Можно ли использовать Qwen Image 2.1 Turbo для коммерческих проектов?
Веса модели выложены под исследовательской лицензией. Это значит, что запускать модель на своих серверах для коммерческих задач можно только с отдельного разрешения Alibaba. Использование через облачный API Alibaba Cloud Model Studio регулируется условиями сервиса.
Какая видеокарта нужна для локального запуска?
Qwen не публикует минимальных требований для Turbo-версии. По оценкам проекта Unsloth, базовая модель Qwen Image 2.1 требует от 11 ГБ видеопамяти в сжатом формате GGUF до 24 ГБ в формате INT8/FP8. Нужна видеокарта NVIDIA с поддержкой CUDA и формата BF16.
Чем Turbo отличается от Pro?
Turbo генерирует изображения за 8 шагов и стоит 0,1 CNY за картинку с лимитом 120 запросов в минуту. Pro стоит 0,25 CNY за изображение с лимитом 20 запросов в минуту. Обе версии доступны через Alibaba Cloud Model Studio. По набору функций обе работают с теми же возможностями базовой Qwen Image 2.1.
Для авторов и маркетологов, которые тратят на визуал больше, чем на текст, Qwen Image 2.1 Turbo даёт конкретный способ сократить расходы без потери разрешения, и проверить это можно за десять минут через API.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Искусственный интеллект в медицине: ИИ-чат-бот совпал с врачами в диагнозах на 90%
Исследование, опубликованное в журнале The Lancet, впервые проверило на практике, как ИИ-чат-бот может готовить пациентов к визиту и разгружать врачей, и…

Картина, нарисованная нейросетью, выиграла в конкурсе Nikon: победу отозвали впервые за 50 лет
Картина, нарисованная нейросетью, выиграла в конкурсе микрофотографии Nikon Small World in Motion, но после проверки была дисквалифицирована: жюри установило,…

ИИ-агенты в программировании дают +30% кода, но ноль новых фич: данные 700 компаний
Компания Jellyfish совместно с исследователями Гарвардского университета опубликовала в июне 2025 года масштабное исследование, которое впервые на данных сотен…
Комментарии