14 августа 2026 года уже упоминавшаяся нами в предыдущих обзорах компания Zhipu AI представила следующую версию своей флагманской модели. Она получила название GLM 5.3. Как и в прошлый раз, сначала новинка появилась только на платном фирменном сервисе компании, а всем действующим подписчикам в тот же день полностью обновили лимиты на использование, так что желающие смогли сразу же попробовать модель в деле без каких-либо дополнительных условий.
Полностью открытые для скачивания и самостоятельного запуска версии модели на момент выхода еще не были готовы: компания объяснила, что перед публикацией внутренних настроек модели проводит дополнительную и достаточно тщательную проверку безопасности, и пообещала выложить их в открытый доступ примерно через две недели после релиза. Такая пауза сама по себе – не редкость на рынке. Однако она означает, что на момент выхода независимые специалисты со стороны еще не могли полноценно протестировать модель на собственном оборудовании и должны были ориентироваться только на данные самой компании.
Та же архитектура, но гораздо более глубокое дообучение
Самое интересное в этом обновлении заключается не в том, что изменилось, а в том, что изменилось на самом деле совсем немного, если смотреть на устройство модели изнутри. Разработчики прямо заявили, что базовая архитектура и размер модели остались точно такими же, как у предыдущей версии, то есть все те же порядка 744 млрд. общих параметров и около 40 млрд. активных на каждый конкретный запрос.
Компания не стала делать модель больше или сложнее, а вместо этого сосредоточилась на этапе так называемого дообучения, когда уже готовую и обученную модель долго и тщательно тренируют решать конкретные практические задачи на огромном количестве примеров и сценариев, постепенно оттачивая ее поведение. По словам самой компании, для этого использовалось в десятки раз больше учебных сценариев, чем при подготовке предыдущей версии, причем сценарии стали еще и заметно более разнообразными по своему характеру и сложности.
Программирование и агентные задачи: заявленный заметный прирост
По собственным заявлениям компании, именно за счет такого более качественного и продолжительного дообучения удалось получить прирост способностей к написанию программного кода примерно в полтора раза по сравнению с предыдущей версией, что довольно много для обновления, в котором не менялась сама архитектура модели. По нескольким открытым тестам на программирование и выполнение сложных многошаговых поручений новая модель заняла первое место среди всех открытых моделей на рынке. А по возможностям в написании кода и решении агентных задач, по утверждению разработчиков, она приблизилась к уровню одной из самых мощных на сегодняшний день закрытых моделей. Стоит, впрочем, иметь в виду, что все эти впечатляющие цифры пока опираются исключительно на собственные измерения самой компании, и независимые специалисты со стороны еще не успели их перепроверить и подтвердить своими собственными тестами на отдельном оборудовании.
Отдельно разработчики решили сделать особый акцент на теме кибербезопасности, и именно эта часть релиза привлекла, пожалуй, больше всего внимания со стороны специалистов. Модель специально обучали находить уязвимости и слабые места в программном обеспечении, причем не просто искать отдельные ошибки по одной, а выстраивать целые связные многошаговые сценарии того, как одну найденную уязвимость можно использовать вместе с другими для получения полного доступа к атакуемой системе. По словам компании, вместе с профильными специалистами по безопасности внутри страны модель уже помогла найти более 2400 уязвимостей почти в трех сотнях самых разных проектов с открытым исходным кодом, причем среди найденных проблем встречались очень старые, которым было по несколько десятков лет и о которых, судя по всему, давно все забыли.
Кибербезопасность и практическое применение
На практике попробовать GLM 5.3 уже можно, даже не дожидаясь публикации открытых весов, поскольку она уже сейчас работает через фирменный инструмент компании для запуска цифровых помощников, а также без особых сложностей подключается к некоторым популярным сторонним средам разработки, которыми пользуются программисты по всему миру, включая инструменты для написания кода с участием искусственного интеллекта. Этот релиз хорошо укладывается в общую картину стремительного роста компании в последнее время: буквально месяцем ранее ее годовая выручка впервые превысила отметку в миллиард долларов, а сама фирма продолжает активно наращивать вычислительные мощности, строя новые дата-центры и закупая все больше оборудования для обучения будущих моделей.
Итоги
По мнению экспертов команды Креатор Проджект, пока что к громким заявлениям о превосходстве новой модели, которые звучат в официальных материалах компании, стоит относиться с определенной долей осторожности. Пока это в основном собственные цифры и внутренние тесты Zhipu, и по-настоящему объективную и полную картину даст только независимая проверка со стороны сторонних специалистов после того, как модель наконец станет полностью открытой и доступной для самостоятельного запуска всеми желающими. До этого момента лучше воспринимать заявленные цифры как ориентир, а не как окончательно доказанный факт, каким бы впечатляющим он ни выглядел на первый взгляд.
.ru