• Виктор
  • Блог
  • 3 мин. чтения

Qwen выпустила Qwen-Image-3.0 — модель генерирует сложные макеты и текст от 10 пикселей


Qwen представила Qwen-Image-3.0 — третье поколение модели для генерации и редактирования изображений. Она принимает инструкции объёмом до 4,5 тысячи токенов, создаёт сложные композиции за один запрос и, по заявлению разработчиков, воспроизводит читаемый текст размером от 10 пикселей.

Модель доступна в Qwen Studio — в веб-версии, а также в приложениях для iOS, Android, macOS и Windows. Подробнее в материале Postium.

Что умеет нейросеть Qwen-Image-3.0

Модель рассчитана на создание изображений с большим количеством взаимосвязанных элементов: газетных полос, раскадровок, учебных материалов, инфографики и интерфейсов. В анонсе Qwen показала сетку 3×3, где в каждой ячейке размещена отдельная сложная схема с текстом, формулами и иллюстрациями. Вся сетка создана одной генерацией по инструкции объёмом 3,7 тысячи токенов.

Qwen-Image-3.0 также умеет строить вложенные композиции. Например, в одном изображении можно задать интерфейс редактора кода, внутри него — окно Qwen Chat, затем мессенджер и постер. По заявлению компании, модель сохраняет структуру и визуальный стиль каждого уровня.

Отдельно Qwen заявляет о более точной прорисовке мелкого текста, формул, дробей, индексов и специальных символов. В примерах модель создавала страницу научной статьи, газетную полосу и рукописные пометки на фотографии книжной страницы.

Для редактирования изображений Qwen-Image-3.0 может добавлять надписи и аннотации, а также восстанавливать утраченные части иллюстраций, сохраняя исходный стиль. В качестве примера компания показала реставрацию традиционной китайской живописи.

Модель поддерживает 12 языков, более 100 художественных стилей, а также генерацию интерфейсов сайтов, игр и трансляций. Qwen также показала создание исследовательской инфографики на основе фото: модель добавила подписи, шкалу, классификацию и увеличенные фрагменты.

Как пользоваться Qwen-Image-3.0

Откройте чат-бот Qwen, выберите режим создания изображения, введите промпт и при необходимости прикрепите исходные изображения.

Для работы через API создайте ключ в Alibaba Cloud Model Studio и укажите в запросе модель qwen-image-3.0-pro.

В один запрос можно включить подробный промпт объёмом до 4,5 тысячи токенов. Например, задать структуру многостраничного макета, тексты, формулы, расположение блоков и стиль.

Для редактирования загрузите исходное изображение и опишите, что нужно изменить: восстановить повреждённый участок, добавить пометки, новые элементы или изменить композицию.

Почему это важно? За последние два дня Alibaba представила Qwen3.8 Max Preview — предварительную флагманскую языковую модель, а также линейку Qwen-Audio-3.0-TTS для озвучивания текста и клонирования голоса. Теперь компания обновила и генератор изображений: Qwen-Image-3.0 делает ставку на создание сложных макетов, работу с мелким текстом и точную передачу визуальных деталей.

Итог: Qwen-Image-3.0 расширяет возможности генерации изображений для создания сложных макетов, инфографики, интерфейсов и редактирования изображений.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Стал известен размер экрана iPhone 20 Pro и Pro Max

В сети появились первые подробности об экранах iPhone 20 Pro и iPhone 20 Pro Max. По данным инсайдера...

Google анонсировала Pics — ИИ-редактор для работы с изображениями

Google анонсировала Pics — новый инструмент для генерации и редактирования изображений в Google Workspace. Он работает на базе...

Как пользоваться QwenWork: регистрация, возможности, бесплатные кредиты и тарифы

QwenWork — это новый ИИ-агент от Alibaba, который доступен на сайте и через отдельное приложение. По принципу работы...

«Звук» запустил «Атлас» — интерактивную карту музыкального вкуса

Музыкальный сервис «Звук» запустил «Атлас» — персональную карту, которая показывает любимые жанры и настроения пользователя. На ней можно...

OpenAI сняла лимиты на текстовые чаты в ChatGPT для всех пользователей

OpenAI объявила об отмене лимитов на текстовые чаты для всех пользователей ChatGPT. Сервис, по данным компании, недавно преодолел...

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и...

Вышел Kling O1 — рассуждающая нейросеть для генерации и редактирования видео

Kling AI выпустила новую ИИ-модель Kling O1 (Omni One). Это рассуждающая нейросеть, которая генерирует видео по тексту и...

Razer выпустила одноручный кейпад Tartarus V2 Pro

Razer начала продажи Tartarus V2 Pro — одноручного игрового кейпада с 31 программируемым элементом управления. Устройство рассчитано на...

Claude Fable 5. Модель ИИ, которой можно сказать «разберись» и уйти пить кофе

Есть такой тип людей, которым нельзя давать простые задачи. Они все равно решат их как-то по-своему, с избыточным...

Miu Miu и New Balance выпустили балетную версию кроссовок 530 SL

Miu Miu и New Balance выпустили балетки на основе 530 SL. От кроссовок модели достались шнуровка, резиновая подошва...

Приложения для создания и обработки фото с помощью ИИ: топ-11 на Android/iPhone

Нужно создать аватар, улучшить старое фото или оживить снимок для соцсетей? Под каждую задачу есть свое приложение, где...

ImagineArt показала модель 2.0

ImagineArt представила модель ImagineArt 2.0 и делает ставку на то, что в генерации изображений пользователям важен уже не...

Вышла Kling Video 3.0 — ИИ-модель для генерации видео из нескольких сцен

Kuaishou выпустила Kling Video 3.0 — новую версию своей модели для генерации видео. Ключевое изменение — теперь ролик...

Pika запустила Relight Media для изменения света в фото и видео

Pika открыла Relight Media — приложение, которое меняет освещение в готовом фото или видеоролике. Пользователь загружает файл, выбирает...

Anthropic выпустила Claude Opus 5.5 – уровень Fable за меньшие деньги

Anthropic выпустила Claude Opus 5.5, первую модель нового поколения Claude 5.5. По заявлению компании, на большинстве задач она...

Pika превратила генератор видео в платформу с набором приложений и мультимодельным стеком

Компания Pika запустила обновленную креативную платформу на pika.art. Сервис перестроили вокруг специализированных мини-приложений для видеомонтажа, ретуши и работы...

Perplexity встроила слайдер вычислительных усилий в агентный сервис Computer

Perplexity добавила слайдер управления вычислительными усилиями в агентный сервис Computer. Пользователи веб-версии платформы могут выбирать глубину рассуждений и...

ElevenLabs представила Composer — редактор песен по секциям

ElevenLabs добавила Composer в сервис Eleven Music. Редактор позволяет начать песню с чистого листа, текстового запроса, собственных слов...

15+ способов продвижения сообщества ВКонтакте в 2026 году

ВКонтакте постоянно меняется: обновляются алгоритмы рекомендаций, появляются новые форматы контента и способы взаимодействия с аудиторией. Поэтому схема «создать...

Krea открыла API для Krea 2 с переносом стиля и мудбордами

Krea открыла API для Krea 2 - своей первой базовой модели генерации изображений, обученной с нуля. Анонс опубликован...