• Виктор
  • Блог
  • 3 мин. чтения

Alibaba выпустила Qwen-Image 2.1 с генерацией прозрачных изображений


Команда Qwen выпустила Qwen-Image 2.1 — модель для генерации и редактирования изображений. Веса опубликованы 20 сентября 2026 года на Hugging Face и ModelScope.

Визуальная часть модели насчитывает 7 млрд параметров. Qwen-Image 2.1 создаёт обычные и прозрачные изображения, принимает до десяти референсов и поддерживает точечное редактирование отдельных областей.

Что умеет Qwen-Image 2.1

Одна модель работает и с текстовыми запросами, и с готовыми изображениями. Пользователь может изменить фон, заменить или удалить предмет, собрать композицию по нескольким референсам и сохранить внешность человека или вид товара.

Для точечных правок нужную область можно отметить кругом, закрасить или передать отдельную маску. Модель поддерживает панорамы, а также генерирует изображения в разрешении 2K с несколькими соотношениями сторон, включая 1:1, 16:9 и 9:16.

Как устроена работа с прозрачным фоном

Qwen-Image 2.1 создаёт изображения с альфа-каналом в формате RGBA. Это позволяет сразу получить объект без фона, изменить отдельный прозрачный слой или вырезать человека либо товар из фотографии.

Прозрачность встроена в модель и не требует отдельного инструмента для удаления фона. В самой модели можно редактировать уже готовые прозрачные изображения.

Где скачать и запустить модель

Веса и код опубликованы на Hugging Face, ModelScope и GitHub. В день релиза модель также получила поддержку Diffusers, ComfyUI, vLLM-Omni, SGLang и LightX2V.

Qwen-Image 2.1 распространяется по Qwen Research License. Она разрешает исследовательское и оценочное использование, а для коммерческих проектов требуется отдельная лицензия Alibaba.

Что изменилось по сравнению с предыдущей версией

Команда Qwen улучшила отрисовку текста, освещение портретов и проработку мелких деталей. Архитектура использует 32 слоя DiT. Для ускорения генерации текстовые инструкции и изображения-контексты вычисляются на первом шаге и затем кэшируются для последующих шагов.

Ранее Alibaba открыла QwenWork по всему миру — ИИ-агент работает в браузере и на компьютере.

Изображения: qwen.ai/blog?id=qwen-image-2.1



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Google запускает Nano Banana – новая эра редактирования изображений

Google представила модель искусственного интеллекта Nano Banana - предварительную версию Gemini 2.5 Flash Image, которая уже доступна пользователям...

Лимиты использования в ChatGPT/Codex: где посмотреть и как сбросить

Даже на платных тарифах ChatGPT действуют лимиты на использование. Если они заканчиваются, сервис может прямо во время работы...

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач

DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash...

Alibaba выпустила Qwen-Image 2.1 с генерацией прозрачных изображений

Команда Qwen выпустила Qwen-Image 2.1 — модель для генерации и редактирования изображений. Веса опубликованы 20 сентября 2026 года...

Нейросеть Sora 2: как пользоваться, где взять инвайт, возможности, как скачать

OpenAI представила Sora 2 — новую версию своей видеомодели, которая автоматически генерирует короткие ролики со звуком и синхронной...

Нейросеть Veo 3.1: как пользоваться и создавать видео бесплатно

Google обновила свою модель для генерации видео — Veo 3.1, и теперь создание роликов со звуком и озвучкой...

Claude Code будет работать в автоматическом режиме по умолчанию

Программирование с Claude Code вскоре будет требовать еще меньше контроля человеком: Anthropic заявила, что начиная с 14 августа сделает...

Google анонсировала Pics — ИИ-редактор для работы с изображениями

Google анонсировала Pics — новый инструмент для генерации и редактирования изображений в Google Workspace. Он работает на базе...

Perplexity открыла исходный код Lily — движка для локальной работы ИИ на Mac

Perplexity открыла исходный код Lily — лёгкого движка инференса для локальной работы с моделями в Perplexity Computer. Он...

Обновление LTX Studio объединило генерацию, апскейл и цветокоррекцию

LTX Studio встроила редактирование изображений прямо в рабочее пространство проекта и тем самым сократила число лишних шагов при...

DeepSeek выпустила Harness v0.2 — приложение для macOS и Windows

У ИИ-агента DeepSeek Harness появилась настольная версия. Теперь его можно установить как обычную программу и поручать ему работу...

Gemini 3.8 Live получила видеоаватар для бизнеса

Google выпустила Gemini 3.8 Live with Live Avatar, режим с почти синхронным видеоаватаром для разговорных моделей. Функция доступна...

Synthesia встроила агента в редактор и обновила модель аватаров

Synthesia запустила Assistant - чат-агента, который собирает ролик из промпта, документа или ссылки прямо в редакторе и правит...

Нейросеть для сложных расчётов: чек-лист для новичка

Недавно нейросеть Claude посчитала физическую задачу, с которой годами возились специалисты — расчёт на девять петель в квантовой...

MiniMax выпустила видеомодель H3 – ролики в 2K со звуком

MiniMax 31 июля представила H3 - мультимодальную видеомодель, которая принимает текст, изображения, видео и звук и выдаёт ролики...

Сверхработоспособный Qwen 3.7 Max. Китайский ИИ, который трудится 35 часов без остановки

Среди всего того, что Alibaba представила на своем облачном саммите в мае 2026 года, флагманская языковая модель Qwen...

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и...

Kling AI выпустила Skill для генерации видео через ИИ-агентов

Kling AI запустила Kling Skills Suite — инструмент, который подключается к сторонним AI-агентам и даёт им доступ к...

Tencent выпустила Hy Image 3.5 Preview для генерации и редактирования изображений

Tencent открыла доступ к Hy Image 3.5 Preview — модели, которая создаёт изображения по тексту и референсам, а...

Miu Miu и New Balance выпустили балетную версию кроссовок 530 SL

Miu Miu и New Balance выпустили балетки на основе 530 SL. От кроссовок модели достались шнуровка, резиновая подошва...