• Виктор
  • Блог
  • 2 мин. чтения

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе


Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и через API, а на следующей неделе компания обещает выпустить открытые веса Qwen3.8‑Max и Qwen3.8‑27B.

Модель принимает текст, изображения и видео, а контекстное окно вмещает до 1 млн токенов. Подробности в материале Postium.

Что известно о Qwen 3.8‑Max

Qwen3.8‑Max построена по архитектуре mixture of experts: при каждом запросе задействуется 95 млрд параметров из 2,4 трлн. Такой подход позволяет не включать всю модель целиком и снижает затраты на вычисления.

По заявлению Alibaba, модель завершила демонстрационный проект по разработке программного обеспечения за 16 дней.

В бенчмарках Qwen3.8-Max обошла GPT-5.6 Sol и Claude Fable 5 по PaperBench, но уступила лидерам в SWE-bench Pro. В Terminal-Bench она показала результат на уровне топовых моделей. В Arena.AI Qwen3.8-Max стала лучшей китайской текстовой моделью и заняла второе место по работе с изображениями.

Доступ и цены: Qwen открыла доступ к Qwen3.8‑Max в Qwen Studio и через API. В анонсе указаны такие тарифы за 1 млн токенов: ввод — $2 (≈159 ₽), вывод — $6 (≈477 ₽), неявное кэширование — $0,25 (≈20 ₽).

Открытые веса пока не опубликованы. Компания обещает выпустить их на следующей неделе вместе с версией Qwen3.8‑27B, но точную дату, лицензию и характеристики младшей модели не назвала.

Как пользоваться Qwen 3.8‑Max бесплатно

Зайдите на сайт Qwen Studio, выберите Qwen3.8‑Max в списке моделей, введите запрос в чате и отправьте его. Модель покажет ответ в том же окне.

Разработчики также могут подключить модель через API QwenCloud, используя идентификатор qwen3.8-max.

Что это меняет? Сейчас Qwen3.8-Max работает как облачная модель. После публикации весов компании и исследовательские команды смогут разворачивать её на собственной серверной инфраструктуре и адаптировать под свои задачи.

Однако модель на 2,4 трлн параметров потребует значительных вычислительных ресурсов. Для локального и корпоративного развёртывания более доступным вариантом может стать Qwen3.8-27B, но оценить её требования можно будет только после публикации характеристик.

Ранее Qwen представила Qwen-Image-3.0 — модель для генерации и редактирования изображений, которая умеет создавать сложные макеты и работать с текстом. До этого Alibaba также выпустила Qwen3.8-Max-Preview — предварительную версию флагманской модели.

Итог: Qwen3.8‑Max уже работает в облаке, а её открытые веса и версия Qwen3.8‑27B заявлены к выпуску на следующей неделе.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

DeepSeek выпустила V4.1 Flash — открытую ИИ-модель с контекстом до 1 млн токенов

DeepSeek выпустила DeepSeek V4.1 Flash и открыла веса модели на Hugging Face. Она принимает текст и изображения, отвечает...

Midjourney V8.1 ускорилась и вернула стиль

Midjourney выпустила альфа-версию V8.1, в которой разработчики сделали ставку на баланс: вернули фирменный визуальный стиль, ускорили генерацию и...

Krea открыла API для Krea 2 с переносом стиля и мудбордами

Krea открыла API для Krea 2 - своей первой базовой модели генерации изображений, обученной с нуля. Анонс опубликован...

GLM 5.2. Мощная модель в открытом доступе

Китайская компания Zhipu AI, которая на международном рынке работает под именем Z.ai, этим летом выпустила новую большую языковую...

В Gemini появились цифровые аватары для Nano Banana

Google добавила в Gemini персональные аватары. Теперь можно один раз записать лицо и голос, после чего создавать изображения...

Что изменилось в новой флагманской модели Anthropic Claude Opus 4.8

В мае 2026 года компания Anthropic обновила флагманскую модель Opus до версии 4.8. И на первый взгляд, этот...

Qwen выпустила Qwen-Image-3.0 — модель генерирует сложные макеты и текст от 10 пикселей

Qwen представила Qwen-Image-3.0 — третье поколение модели для генерации и редактирования изображений. Она принимает инструкции объёмом до 4,5...

DeepSeek API: как получить ключ, как пользоваться бесплатно, как оплатить из России

DeepSeek API – это облачный сервис, который позволяет подключать ИИ-модели к внешним проектам. С его помощью можно интегрировать...

ByteDance выпустила Seedream 4.0 — ИИ модель для генерации изображений, обгоняющую Nano Banana

ByteDance представила Seedream 4.0 — новую модель генерации и редактирования изображений, которая работает быстрее и стабильнее конкурентов. По...

Консистентность персонажей и стилей в нейросетях — что это и как сохранить

Представьте: вы потратили битый час на промт и наконец получили идеального персонажа. Делаете следующий шаг — просите его...

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

Alibaba официально запустила Wan3.0 - видеомодель, которая делает ролик длиной до 30 секунд из текста, картинок, аудио и...

Kling представил VIDEO 2.6 — ИИ-модель, которая генерирует видео и звук за один прогон

Kling запустил модель VIDEO 2.6 — свой первый генератор, который создаёт картинку и звук одновременно. Один запрос превращается...

Новое поколение DLSS 5 от NVIDIA: революционный ИИ-рендеринг выйдет 3 сентября

Компания NVIDIA официально анонсировала технологию DLSS 5, запуск которой запланирован на 3 сентября 2026 года. Первой игрой с...

Вышел Kling O1 — рассуждающая нейросеть для генерации и редактирования видео

Kling AI выпустила новую ИИ-модель Kling O1 (Omni One). Это рассуждающая нейросеть, которая генерирует видео по тексту и...

От Google Translate к Gemini. Новая модель приближает синхронный перевод к живому диалогу

Двадцать лет назад Google Translate был всего лишь одним из первых машинных экспериментов с языком. Сначала он переводил...

Claude Code будет работать в автоматическом режиме по умолчанию

Программирование с Claude Code вскоре будет требовать еще меньше контроля человеком: Anthropic заявила, что начиная с 14 августа сделает...

Google выпустила Nano Banana 2 Lite и Gemini Omni Flash

30 июня Google открыла доступ к двум новым моделям генеративной графики и видео - Nano Banana 2 Lite...

Suno Studio 2.0 приближается к полноценной DAW благодаря поддержке MIDI и чат-боту с ИИ

Suno представила Studio 2.0 со значительными обновлениями, которые приближают ее к полноценной цифровой звуковой рабочей станции (DAW), а не к...

Suno вводит лимиты на скачивание — до 7 треков бесплатно

Suno объявила, что с 3 сентября введёт лимиты на скачивание созданной музыки. На бесплатном тарифе пользователи, зарегистрировавшиеся до...

Yandex AI Studio позволит создавать ИИ-агентов на базе DeepSeek-V3.2

Yandex B2B Tech представила обновление Yandex AI Studio — платформы для разработки ИИ-приложений. Главное изменение: бизнес получил возможность...