• Виктор
  • Блог
  • 1 мин. чтения

GLM 5.3: мощнее в коде и кибербезопасности


14 августа 2026 года уже упоминавшаяся нами в предыдущих обзорах компания Zhipu AI представила следующую версию своей флагманской модели. Она получила название GLM 5.3. Как и в прошлый раз, сначала новинка появилась только на платном фирменном сервисе компании, а всем действующим подписчикам в тот же день полностью обновили лимиты на использование, так что желающие смогли сразу же попробовать модель в деле без каких-либо дополнительных условий.

Полностью открытые для скачивания и самостоятельного запуска версии модели на момент выхода еще не были готовы: компания объяснила, что перед публикацией внутренних настроек модели проводит дополнительную и достаточно тщательную проверку безопасности, и пообещала выложить их в открытый доступ примерно через две недели после релиза. Такая пауза сама по себе – не редкость на рынке. Однако она означает, что на момент выхода независимые специалисты со стороны еще не могли полноценно протестировать модель на собственном оборудовании и должны были ориентироваться только на данные самой компании.

Та же архитектура, но гораздо более глубокое дообучение

Самое интересное в этом обновлении заключается не в том, что изменилось, а в том, что изменилось на самом деле совсем немного, если смотреть на устройство модели изнутри. Разработчики прямо заявили, что базовая архитектура и размер модели остались точно такими же, как у предыдущей версии, то есть все те же порядка 744 млрд. общих параметров и около 40 млрд. активных на каждый конкретный запрос.

Компания не стала делать модель больше или сложнее, а вместо этого сосредоточилась на этапе так называемого дообучения, когда уже готовую и обученную модель долго и тщательно тренируют решать конкретные практические задачи на огромном количестве примеров и сценариев, постепенно оттачивая ее поведение. По словам самой компании, для этого использовалось в десятки раз больше учебных сценариев, чем при подготовке предыдущей версии, причем сценарии стали еще и заметно более разнообразными по своему характеру и сложности.

Программирование и агентные задачи: заявленный заметный прирост

По собственным заявлениям компании, именно за счет такого более качественного и продолжительного дообучения удалось получить прирост способностей к написанию программного кода примерно в полтора раза по сравнению с предыдущей версией, что довольно много для обновления, в котором не менялась сама архитектура модели. По нескольким открытым тестам на программирование и выполнение сложных многошаговых поручений новая модель заняла первое место среди всех открытых моделей на рынке. А по возможностям в написании кода и решении агентных задач, по утверждению разработчиков, она приблизилась к уровню одной из самых мощных на сегодняшний день закрытых моделей. Стоит, впрочем, иметь в виду, что все эти впечатляющие цифры пока опираются исключительно на собственные измерения самой компании, и независимые специалисты со стороны еще не успели их перепроверить и подтвердить своими собственными тестами на отдельном оборудовании.

Отдельно разработчики решили сделать особый акцент на теме кибербезопасности, и именно эта часть релиза привлекла, пожалуй, больше всего внимания со стороны специалистов. Модель специально обучали находить уязвимости и слабые места в программном обеспечении, причем не просто искать отдельные ошибки по одной, а выстраивать целые связные многошаговые сценарии того, как одну найденную уязвимость можно использовать вместе с другими для получения полного доступа к атакуемой системе. По словам компании, вместе с профильными специалистами по безопасности внутри страны модель уже помогла найти более 2400 уязвимостей почти в трех сотнях самых разных проектов с открытым исходным кодом, причем среди найденных проблем встречались очень старые, которым было по несколько десятков лет и о которых, судя по всему, давно все забыли.

Кибербезопасность и практическое применение

На практике попробовать GLM 5.3 уже можно, даже не дожидаясь публикации открытых весов, поскольку она уже сейчас работает через фирменный инструмент компании для запуска цифровых помощников, а также без особых сложностей подключается к некоторым популярным сторонним средам разработки, которыми пользуются программисты по всему миру, включая инструменты для написания кода с участием искусственного интеллекта. Этот релиз хорошо укладывается в общую картину стремительного роста компании в последнее время: буквально месяцем ранее ее годовая выручка впервые превысила отметку в миллиард долларов, а сама фирма продолжает активно наращивать вычислительные мощности, строя новые дата-центры и закупая все больше оборудования для обучения будущих моделей.

Итоги

По мнению экспертов команды Креатор Проджект, пока что к громким заявлениям о превосходстве новой модели, которые звучат в официальных материалах компании, стоит относиться с определенной долей осторожности. Пока это в основном собственные цифры и внутренние тесты Zhipu, и по-настоящему объективную и полную картину даст только независимая проверка со стороны сторонних специалистов после того, как модель наконец станет полностью открытой и доступной для самостоятельного запуска всеми желающими. До этого момента лучше воспринимать заявленные цифры как ориентир, а не как окончательно доказанный факт, каким бы впечатляющим он ни выглядел на первый взгляд.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Claude Fable 5. Модель ИИ, которой можно сказать «разберись» и уйти пить кофе

Есть такой тип людей, которым нельзя давать простые задачи. Они все равно решат их как-то по-своему, с избыточным...

ElevenLabs теперь можно подключить к Claude через MCP

ElevenLabs представила MCP-сервер для Claude. Он позволяет управлять агентами ElevenLabs из чата в Claude. Коннектор уже появился в...

Kling запустила IMAGE O1 — новую ИИ-модель для генерации и редактирования изображений

Kling представила «IMAGE O1» — это обновлённая модель для генерации и редактирования изображений. Она работает и с текстом,...

OpenAI выпустила GPT-6 Sol и GPT-6 Luna — новые модели уже доступны в ChatGPT и Codex

OpenAI начала развёртывание GPT-6 Sol и GPT-6 Luna. Новые модели уже появляются в ChatGPT Work и Codex, а...

Нейросеть Veo 3.1: как пользоваться и создавать видео бесплатно

Google обновила свою модель для генерации видео — Veo 3.1, и теперь создание роликов со звуком и озвучкой...

OpenAI стандартизировала отчёты об отклонениях и скрытом поведении ИИ-моделей

OpenAI представила фреймворк для отчётов о рассогласовании моделей (Model Misalignment Reporting Framework). Компания стандартизировала сбор данных об опасных...

Gemini взломала три компании на испытаниях и остановилась сама

Gemini во время майских кибериспытаний вошла в системы трёх реальных компаний. В одном случае модель подобрала пароль, в...

Глава Microsoft AI назвал новые отчёты OpenAI серьёзной ситуацией

Мустафа Сулейман, глава Microsoft AI, назвал в эфире CNBC 18 сентября раскрытые OpenAI случаи странного поведения моделей «довольно...

ByteDance открыла публичный API Seedance 2.5

7 августа Volcano Engine открыла публичный API Seedance 2.5 - видеомодели ByteDance, которая одним проходом собирает 30-секундный ролик...

PixVerse обновила партнёрскую программу для авторов AI-видео

PixVerse представила Global Creative Partner Program 2.0 - обновлённую партнёрскую программу для авторов AI-видео. Участникам обещают кредиты, денежные...

20 промтов для осенней ИИ-фотосессии в нейросетях

Осенняя фотосессия не обязательно требует поездки в парк, холодной погоды и пары часов на съёмку. Если у вас...

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач

DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash...

Anthropic выпустила Claude Opus 5.5 — модель стала быстрее и дешевле 

Anthropic выпустила Claude Opus 5.5 для Claude, Claude Code и Claude Platform. Новая модель генерирует ответы более чем...

Нейросеть Кандинский 3.0: как пользоваться, как обрабатывать фото и создавать картинки

Кандинский – это бесплатная нейросеть от Сбера, способная генерировать картинки по текстовому описанию. Работает по сходному с Midjourney...

Новые фишки и функции iOS 27 для iPhone — 13 главных обновлений

Недавно Apple выпустила iOS 27 — обновление доступно для iPhone 11 и более новых моделей, а также iPhone...

OpenAI выпустила GPT-6 Sol и Luna и вдвое снизила цены

OpenAI выпустила GPT-6 Sol и GPT-6 Luna, среднюю и младшую модели поколения GPT-6. Они построены на наработках флагманской...

История Starbucks: кто основал компанию, как появился логотип и кому принадлежит бренд

Сегодня Starbucks — одна из самых узнаваемых кофейных сетей мира: зелёную сирену знают даже те, кто ни разу...

Сверхработоспособный Qwen 3.7 Max. Китайский ИИ, который трудится 35 часов без остановки

Среди всего того, что Alibaba представила на своем облачном саммите в мае 2026 года, флагманская языковая модель Qwen...

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и...

Проверка текста нейросетью: частые ошибки новичков

Люди приходят к нейросети с текстом так же, как раньше несли его редактору: «вот, посмотри, всё ли нормально»....