• Виктор
  • Блог
  • 2 мин. чтения

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе


Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и через API, а на следующей неделе компания обещает выпустить открытые веса Qwen3.8‑Max и Qwen3.8‑27B.

Модель принимает текст, изображения и видео, а контекстное окно вмещает до 1 млн токенов. Подробности в материале Postium.

Что известно о Qwen 3.8‑Max

Qwen3.8‑Max построена по архитектуре mixture of experts: при каждом запросе задействуется 95 млрд параметров из 2,4 трлн. Такой подход позволяет не включать всю модель целиком и снижает затраты на вычисления.

По заявлению Alibaba, модель завершила демонстрационный проект по разработке программного обеспечения за 16 дней.

В бенчмарках Qwen3.8-Max обошла GPT-5.6 Sol и Claude Fable 5 по PaperBench, но уступила лидерам в SWE-bench Pro. В Terminal-Bench она показала результат на уровне топовых моделей. В Arena.AI Qwen3.8-Max стала лучшей китайской текстовой моделью и заняла второе место по работе с изображениями.

Доступ и цены: Qwen открыла доступ к Qwen3.8‑Max в Qwen Studio и через API. В анонсе указаны такие тарифы за 1 млн токенов: ввод — $2 (≈159 ₽), вывод — $6 (≈477 ₽), неявное кэширование — $0,25 (≈20 ₽).

Открытые веса пока не опубликованы. Компания обещает выпустить их на следующей неделе вместе с версией Qwen3.8‑27B, но точную дату, лицензию и характеристики младшей модели не назвала.

Как пользоваться Qwen 3.8‑Max бесплатно

Зайдите на сайт Qwen Studio, выберите Qwen3.8‑Max в списке моделей, введите запрос в чате и отправьте его. Модель покажет ответ в том же окне.

Разработчики также могут подключить модель через API QwenCloud, используя идентификатор qwen3.8-max.

Что это меняет? Сейчас Qwen3.8-Max работает как облачная модель. После публикации весов компании и исследовательские команды смогут разворачивать её на собственной серверной инфраструктуре и адаптировать под свои задачи.

Однако модель на 2,4 трлн параметров потребует значительных вычислительных ресурсов. Для локального и корпоративного развёртывания более доступным вариантом может стать Qwen3.8-27B, но оценить её требования можно будет только после публикации характеристик.

Ранее Qwen представила Qwen-Image-3.0 — модель для генерации и редактирования изображений, которая умеет создавать сложные макеты и работать с текстом. До этого Alibaba также выпустила Qwen3.8-Max-Preview — предварительную версию флагманской модели.

Итог: Qwen3.8‑Max уже работает в облаке, а её открытые веса и версия Qwen3.8‑27B заявлены к выпуску на следующей неделе.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Perplexity встроила слайдер вычислительных усилий в агентный сервис Computer

Perplexity добавила слайдер управления вычислительными усилиями в агентный сервис Computer. Пользователи веб-версии платформы могут выбирать глубину рассуждений и...

Runway представила Multi-Shot App: от одного промпта к полноценной многосценной истории с диалогами, звуком и монтажом

Runway представила новый инструмент, который заметно упрощает создание видеоконтента с помощью нейросетей. Multi-Shot App превращает один текстовый запрос...

Как пользоваться Nano Banana 2 Lite бесплатно — гайд

Недавно Google выпустил нейросеть Nano Banana 2 Lite — облегчённую версию генератора изображений на базе Gemini. ИИ-модель быстро...

Сверхработоспособный Qwen 3.7 Max. Китайский ИИ, который трудится 35 часов без остановки

Среди всего того, что Alibaba представила на своем облачном саммите в мае 2026 года, флагманская языковая модель Qwen...

DeepSeek представила DeepSeek-OCR — новую модель для сжатия визуального контекста в LLM

Компания DeepSeek показала DeepSeek-OCR — OCR-модель, созданную специально для больших языковых моделей. Вместо обычного распознавания текста она сжимает...

Suno выпустила Studio 2.0 — добавили поддержку MIDI и синтезатор

Suno выпустила Studio 2.0 — обновление браузерной рабочей станции для создания музыки. В ней появились MIDI-дорожки с возможностью...

Kimi управляет сайтами из боковой панели Chrome и запоминает действия

Kimi теперь открывает сайты, нажимает кнопки и заполняет формы по просьбе, написанной в чате. Moonshot AI переименовала своё...

Runway выпустила Aleph 2.0: точечное ИИ-редактирование видео по одному кадру

Американская компания Runway представила Aleph 2.0 - крупное обновление своей ИИ-модели для точечного изменения видеоматериалов. Инструмент, встроенный в...

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Alibaba выпустила Qwen-Image-3.0 - третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий...

Новое поколение DLSS 5 от NVIDIA: революционный ИИ-рендеринг выйдет 3 сентября

Компания NVIDIA официально анонсировала технологию DLSS 5, запуск которой запланирован на 3 сентября 2026 года. Первой игрой с...

Krea открыла API для Krea 2 с переносом стиля и мудбордами

Krea открыла API для Krea 2 - своей первой базовой модели генерации изображений, обученной с нуля. Анонс опубликован...

OpenAI стандартизировала отчёты об отклонениях и скрытом поведении ИИ-моделей

OpenAI представила фреймворк для отчётов о рассогласовании моделей (Model Misalignment Reporting Framework). Компания стандартизировала сбор данных об опасных...

Приложения для создания и обработки фото с помощью ИИ: топ-11 на Android/iPhone

Нужно создать аватар, улучшить старое фото или оживить снимок для соцсетей? Под каждую задачу есть свое приложение, где...

DeepSeek API: как получить ключ, как пользоваться бесплатно, как оплатить из России

DeepSeek API – это облачный сервис, который позволяет подключать ИИ-модели к внешним проектам. С его помощью можно интегрировать...

Gemini 3.8 Live получила видеоаватар для бизнеса

Google выпустила Gemini 3.8 Live with Live Avatar, режим с почти синхронным видеоаватаром для разговорных моделей. Функция доступна...

Google довела ролики Gemini Omni до сорока секунд и сделала черновики втрое дешевле

Gemini Omni 1.1 Flash научилась достраивать снятую сцену продолжениями и доводить ролик до сорока секунд, а перед чистовой...

Яндекс Люмен: что за подписка, сколько стоит, как подключить/отключить

«Яндекс Люмен» появился летом 2026 года. Сначала его запустили в Яндекс Музыке, затем добавили функции в Яндекс Книги....

Runway показала GWM Worlds 2 – интерактивный мир вместо видеоролика

Runway 3 сентября показала GWM Worlds 2 - мировую модель, которая выдаёт живое интерактивное пространство вместо готового ролика....

Kling 4.0 выйдет в октябре, а Flash уже доступна подписчикам Ultra

Kling AI анонсировала видеомодель Kling 4.0 с выходом в октябре, а облегчённая Kling 4.0 Flash уже работает у...

Suno Studio 2.0 приближается к полноценной DAW благодаря поддержке MIDI и чат-боту с ИИ

Suno представила Studio 2.0 со значительными обновлениями, которые приближают ее к полноценной цифровой звуковой рабочей станции (DAW), а не к...