• Виктор
  • Блог
  • 3 мин. чтения

Qwen выпустила Qwen-Image-3.0 — модель генерирует сложные макеты и текст от 10 пикселей


Qwen представила Qwen-Image-3.0 — третье поколение модели для генерации и редактирования изображений. Она принимает инструкции объёмом до 4,5 тысячи токенов, создаёт сложные композиции за один запрос и, по заявлению разработчиков, воспроизводит читаемый текст размером от 10 пикселей.

Модель доступна в Qwen Studio — в веб-версии, а также в приложениях для iOS, Android, macOS и Windows. Подробнее в материале Postium.

Что умеет нейросеть Qwen-Image-3.0

Модель рассчитана на создание изображений с большим количеством взаимосвязанных элементов: газетных полос, раскадровок, учебных материалов, инфографики и интерфейсов. В анонсе Qwen показала сетку 3×3, где в каждой ячейке размещена отдельная сложная схема с текстом, формулами и иллюстрациями. Вся сетка создана одной генерацией по инструкции объёмом 3,7 тысячи токенов.

Qwen-Image-3.0 также умеет строить вложенные композиции. Например, в одном изображении можно задать интерфейс редактора кода, внутри него — окно Qwen Chat, затем мессенджер и постер. По заявлению компании, модель сохраняет структуру и визуальный стиль каждого уровня.

Отдельно Qwen заявляет о более точной прорисовке мелкого текста, формул, дробей, индексов и специальных символов. В примерах модель создавала страницу научной статьи, газетную полосу и рукописные пометки на фотографии книжной страницы.

Для редактирования изображений Qwen-Image-3.0 может добавлять надписи и аннотации, а также восстанавливать утраченные части иллюстраций, сохраняя исходный стиль. В качестве примера компания показала реставрацию традиционной китайской живописи.

Модель поддерживает 12 языков, более 100 художественных стилей, а также генерацию интерфейсов сайтов, игр и трансляций. Qwen также показала создание исследовательской инфографики на основе фото: модель добавила подписи, шкалу, классификацию и увеличенные фрагменты.

Как пользоваться Qwen-Image-3.0

Откройте чат-бот Qwen, выберите режим создания изображения, введите промпт и при необходимости прикрепите исходные изображения.

Для работы через API создайте ключ в Alibaba Cloud Model Studio и укажите в запросе модель qwen-image-3.0-pro.

В один запрос можно включить подробный промпт объёмом до 4,5 тысячи токенов. Например, задать структуру многостраничного макета, тексты, формулы, расположение блоков и стиль.

Для редактирования загрузите исходное изображение и опишите, что нужно изменить: восстановить повреждённый участок, добавить пометки, новые элементы или изменить композицию.

Почему это важно? За последние два дня Alibaba представила Qwen3.8 Max Preview — предварительную флагманскую языковую модель, а также линейку Qwen-Audio-3.0-TTS для озвучивания текста и клонирования голоса. Теперь компания обновила и генератор изображений: Qwen-Image-3.0 делает ставку на создание сложных макетов, работу с мелким текстом и точную передачу визуальных деталей.

Итог: Qwen-Image-3.0 расширяет возможности генерации изображений для создания сложных макетов, инфографики, интерфейсов и редактирования изображений.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Gemini 3.8 Live получила видеоаватар для бизнеса

Google выпустила Gemini 3.8 Live with Live Avatar, режим с почти синхронным видеоаватаром для разговорных моделей. Функция доступна...

Google теперь позволит пользователям удалять видимый водяной знак со своих ИИ-генераций

В пятницу Google объявила, что теперь позволит пользователям удалять видимый водяной знак со своих материалов, созданных ИИ, включая...

Gemini взломала три компании на испытаниях и остановилась сама

Gemini во время майских кибериспытаний вошла в системы трёх реальных компаний. В одном случае модель подобрала пароль, в...

Perplexity встроила слайдер вычислительных усилий в агентный сервис Computer

Perplexity добавила слайдер управления вычислительными усилиями в агентный сервис Computer. Пользователи веб-версии платформы могут выбирать глубину рассуждений и...

Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

xAI добавила в Grok Imagine референсы: до семи опорных изображений на генерацию закрепляют лицо персонажа, товар или локацию,...

ByteDance открыла публичный API Seedance 2.5

7 августа Volcano Engine открыла публичный API Seedance 2.5 - видеомодели ByteDance, которая одним проходом собирает 30-секундный ролик...

Яндекс сводит аналитику данных в одну платформу

Yandex B2B Tech анонсировала DataLens Platform, платформу для работы с корпоративными данными от загрузки и хранения до отчётов...

Google научила Antigravity SDK работать с локальными моделями без интернета

Google научила Antigravity SDK запускать ИИ-агентов на локальных моделях, в том числе без интернета. Первой поддержана открытая Gemma...

Razer выпустила одноручный кейпад Tartarus V2 Pro

Razer начала продажи Tartarus V2 Pro — одноручного игрового кейпада с 31 программируемым элементом управления. Устройство рассчитано на...

Krea AI представила Krea 2 – собственную модель для генерации изображений

Krea AI 12 мая 2026 года анонсировала Krea 2 — новую модель для генерации изображений. В ветке компания...

Ideogram выпустила Ideogram 4.0 с открытыми весами и управлением макетом через JSON

Ideogram представила версию 4.0 - новую text-to-image модель с открытыми весами для генерации изображений, дизайна и типографики. Компания...

Yandex AI Studio позволит создавать ИИ-агентов на базе DeepSeek-V3.2

Yandex B2B Tech представила обновление Yandex AI Studio — платформы для разработки ИИ-приложений. Главное изменение: бизнес получил возможность...

Вышла нейросеть Suno 5.5 — ИИ генерирует треки с вашим голосом

Suno AI выпустила модель v5.5 и вместе с ней набор функций, которые меняют логику сервиса. Теперь это не...

Лимиты использования в ChatGPT/Codex: где посмотреть и как сбросить

Даже на платных тарифах ChatGPT действуют лимиты на использование. Если они заканчиваются, сервис может прямо во время работы...

Обновление LTX Studio объединило генерацию, апскейл и цветокоррекцию

LTX Studio встроила редактирование изображений прямо в рабочее пространство проекта и тем самым сократила число лишних шагов при...

Grok научился расшифровывать речь вдвое точнее и за те же деньги

SpaceXAI выпустила Grok Voice Transcribe 2.0, модель для перевода речи в текст. По внутренним тестам компании она вдвое...

Глава Microsoft AI назвал новые отчёты OpenAI серьёзной ситуацией

Мустафа Сулейман, глава Microsoft AI, назвал в эфире CNBC 18 сентября раскрытые OpenAI случаи странного поведения моделей «довольно...

Подписка на Suno AI: тарифы, как купить из России и сколько стоит трек

Если вы открыли эту статью, то, скорее всего, уже знакомы с Suno AI: знаете, как работает нейросеть, и...

Новое поколение DLSS 5 от NVIDIA: революционный ИИ-рендеринг выйдет 3 сентября

Компания NVIDIA официально анонсировала технологию DLSS 5, запуск которой запланирован на 3 сентября 2026 года. Первой игрой с...

Runway выпустила Aleph 2.0: точечное ИИ-редактирование видео по одному кадру

Американская компания Runway представила Aleph 2.0 - крупное обновление своей ИИ-модели для точечного изменения видеоматериалов. Инструмент, встроенный в...