• Виктор
  • Блог
  • 2 мин. чтения

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов


Alibaba выпустила Qwen-Image-3.0 – третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий текст, сборка сложных инфографик за один проход. Бенчмарков, весов и технического отчёта компания не раскрыла.

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Промпт на 4500 токенов вместо тысячи

Прежняя версия, Qwen -Image 2.0 , принимала подписи максимум на тысячу токенов. Qwen-Image-3.0 увеличила лимит в 4,5 раза, и это не просто техническая деталь. С длинным промптом модель собирает композиции, которые раньше требовали склейки нескольких картинок. Витринный пример команды Qwen – сетка три на три с девятью разными иллюстрациями (диаграмма по физике, доказательство из теории групп, разбор по биологии и ещё шесть), собранная из одной инструкции на 3700 токенов. Второй пример – вложенные интерфейсы: редактор кода, внутри которого открыто окно чата, а внутри чата – мессенджер.

Текст размером в десять пикселей

Вторая заявленная сильная сторона – мелкая деталь. Alibaba утверждает, что модель читаемо рендерит текст высотой всего десять пикселей и воспроизводит фактуру кожи, волос и бумаги почти на уровне фотографии. В галерее релиза – разворот академической статьи с многострочными формулами, макет газетной полосы, добавление рукописных пометок на готовое изображение и реставрация повреждённой картины в традиционной технике.

Модель, которая подглядывает в прогноз погоды

Третий блок команда называет «мировыми знаниями»: нативный рендеринг на 12 языках и больше чем 20 шрифтов, воспроизведение интерфейсов вроде веб-страниц и трансляций, и способность подтягивать актуальные данные из сети прямо в изображение. Пример из презентации – график прогноза погоды для конкретного города на конкретную дату. Для генератора картинок это необычная претензия: модель здесь работает не только с формой, но и с содержанием, которое само по себе должно быть верным.

Газетные полосы, сторибоарды, карточки товаров

Alibaba целится в контент-продакшен: вёрстку новостных полос, сторибоарды для короткометражных драм, макеты интерфейсов, карточки для маркетплейсов. Ровно тот сегмент, где вопрос о раскрытии участия ИИ в производстве материала уже не абстрактный, а рабочий – редакции и агентства такие изображения публикуют массово. Обе стороны примеров команда выбирала сама, и удобство для конкретной задачи ещё предстоит проверить на чужих промптах, а не на витринных.

Ни весов, ни отчёта, ни лицензии

Пост о релизе не содержит таблицы с бенчмарками, числа параметров, лицензии и технического отчёта о том, как модель обучали и тестировали. Попробовать её можно только через Qwen Chat. Это разворот на 180 градусов относительно того, как серия выходила раньше. Qwen-Image 1.0 в августе 2025 года вышла сразу с открытыми весами под лицензией Apache 2.0 и техническим отчётом день в день. У Qwen-Image 2.0 был собственный технический отчёт, и там же фигурировал прежний лимит в тысячу токенов – единственная цифра из старого релиза, с которой теперь можно сравнить новую. Для генератора изображений закрытость обиднее, чем для текстовой модели: качество тут субъективно, а рендеринг текста – как раз то направление, где демо на подобранных примерах обычно выглядит сильнее, чем модель под системным тестированием.

Пятое место как точка отсчёта

У Alibaba есть собственный ориентир, откуда считать прогресс. В бенчмарке Qwen-Image-Bench, который команда Qwen опубликовала сама, предыдущий флагман Qwen Image 2.0 Pro занял пятое место. Первую строчку держит GPT Image 2 от OpenAI , следом идут модели Nano Banana от Google и GPT Image 1.5. Оценка построена на модели-судье, которая, по словам авторов бенчмарка, хорошо совпадает с оценками живых людей, но тест всё равно собственный, а мерили им прошлое поколение, а не 3.0.

Пятое место – не худший старт, но и не тот, с которого закрытые бенчмарки выглядят убедительно. Заявка на скачок есть, а способа её проверить со стороны – нет.

Tencent и Thinking Machines показывают, что закрытость – выбор

Конкуренты в те же недели поступили иначе. Tencent выпустила HunyuanImage 3.0 с открытыми весами, а Thinking Machines Lab свою первую мультимодальную модель Inkling тоже отдала с весами в комплекте. На этом фоне решение Qwen читается не как техническое ограничение, а как коммерческий расчёт: пока конкуренты делятся моделями, Alibaba бережёт свежий релиз для собственного чат-продукта. Судить, оправдан ли скачок с тысячи до 4500 токенов и заявленная читаемость десятипиксельного текста, можно будет только по одному признаку – появятся ли веса, карточка модели и независимые тесты. До этого момента у разработчиков есть только подборка картинок, которую выбрала сама компания.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

GLM 5.3: мощнее в коде и кибербезопасности

14 августа 2026 года уже упоминавшаяся нами в предыдущих обзорах компания Zhipu AI представила следующую версию своей флагманской...

Вышла новая ChatGPT Images 2.5 которая правит картинку по комментариям и наброску

OpenAI выпустила ChatGPT Images 2.5 - обновление генератора картинок с правками по комментариям прямо на изображении, режимом рисования...

Miu Miu и New Balance выпустили балетную версию кроссовок 530 SL

Miu Miu и New Balance выпустили балетки на основе 530 SL. От кроссовок модели достались шнуровка, резиновая подошва...

ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

ElevenLabs расширила свой MCP-сервер. Теперь подключённый ИИ-ассистент может создавать речь, музыку, звуковые эффекты, изображения и видео, а также...

Обзор платформы lava.top

lava.top — это международная платформа для продажи контента, позволяющая создавать и продавать цифровые продукты без подключения дополнительных платежных...

Pika Labs запустила Pika Agents

Pika Labs вывела Pika Agents в открытый доступ и предложила другой способ работы с генеративным ИИ. Вместо привычного...

OpenAI представила GPT 5.6. Три модели, новые агенты и снижение цен

Летом 2026 года компания OpenAI представила свое новое семейство моделей под общим названием GPT 5.6. Релиз получился довольно...

«Ёбидоёби» запустила коллаборацию с Atomic Heart

Служба доставки «Ёбидоёби» запустила коллаборацию с Atomic Heart. В меню появился одноимённый набор из 40 роллов в лимитированной...

ElevenLabs представила Studio 4.0 с генерацией видео, изображений и звука

ElevenLabs выпустила Studio 4.0 — обновлённый редактор, а также Studio Agent. В одном проекте теперь можно генерировать видео,...

Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям

xAI открыла общий доступ к Imagine Image 2.0 - новому режиму Quality в Grok Imagine на сайте и...

Tencent выпустила Hy Image 3.5 Preview для генерации и редактирования изображений

Tencent открыла доступ к Hy Image 3.5 Preview — модели, которая создаёт изображения по тексту и референсам, а...

Новые фишки и функции iOS 27 для iPhone — 13 главных обновлений

Недавно Apple выпустила iOS 27 — обновление доступно для iPhone 11 и более новых моделей, а также iPhone...

Как пользоваться QwenWork: регистрация, возможности, бесплатные кредиты и тарифы

QwenWork — это новый ИИ-агент от Alibaba, который доступен на сайте и через отдельное приложение. По принципу работы...

Comfy MCP: ComfyUI подключает ИИ-агентов к своим пайплайнам генерации

Команда ComfyUI открыла публичную бету Comfy MCP - коннектор, через который ИИ-агенты вроде Claude, Codex, Cursor и Hermes...

Suno выпустила Studio 2.0 — добавили поддержку MIDI и синтезатор

Suno выпустила Studio 2.0 — обновление браузерной рабочей станции для создания музыки. В ней появились MIDI-дорожки с возможностью...

Обновление LTX Studio объединило генерацию, апскейл и цветокоррекцию

LTX Studio встроила редактирование изображений прямо в рабочее пространство проекта и тем самым сократила число лишних шагов при...

Стал известен размер экрана iPhone 20 Pro и Pro Max

В сети появились первые подробности об экранах iPhone 20 Pro и iPhone 20 Pro Max. По данным инсайдера...

Google выпустила Nano Banana 2 Lite и Gemini Omni Flash

30 июня Google открыла доступ к двум новым моделям генеративной графики и видео - Nano Banana 2 Lite...

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач

DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash...

DeepSeek API: как получить ключ, как пользоваться бесплатно, как оплатить из России

DeepSeek API – это облачный сервис, который позволяет подключать ИИ-модели к внешним проектам. С его помощью можно интегрировать...