GLM 5.3: мощнее в коде и кибербезопасности

14 августа 2026 года уже упоминавшаяся нами в предыдущих обзорах компания Zhipu AI представила следующую версию своей флагманской модели. Она получила название GLM 5.3. Как и в прошлый раз, сначала новинка появилась только на платном фирменном сервисе компании, а всем действующим подписчикам в тот же день полностью обновили лимиты на использование, так что желающие смогли сразу же попробовать модель в деле без каких-либо дополнительных условий.

Полностью открытые для скачивания и самостоятельного запуска версии модели на момент выхода еще не были готовы: компания объяснила, что перед публикацией внутренних настроек модели проводит дополнительную и достаточно тщательную проверку безопасности, и пообещала выложить их в открытый доступ примерно через две недели после релиза. Такая пауза сама по себе – не редкость на рынке. Однако она означает, что на момент выхода независимые специалисты со стороны еще не могли полноценно протестировать модель на собственном оборудовании и должны были ориентироваться только на данные самой компании.

Та же архитектура, но гораздо более глубокое дообучение

Самое интересное в этом обновлении заключается не в том, что изменилось, а в том, что изменилось на самом деле совсем немного, если смотреть на устройство модели изнутри. Разработчики прямо заявили, что базовая архитектура и размер модели остались точно такими же, как у предыдущей версии, то есть все те же порядка 744 млрд. общих параметров и около 40 млрд. активных на каждый конкретный запрос.

Компания не стала делать модель больше или сложнее, а вместо этого сосредоточилась на этапе так называемого дообучения, когда уже готовую и обученную модель долго и тщательно тренируют решать конкретные практические задачи на огромном количестве примеров и сценариев, постепенно оттачивая ее поведение. По словам самой компании, для этого использовалось в десятки раз больше учебных сценариев, чем при подготовке предыдущей версии, причем сценарии стали еще и заметно более разнообразными по своему характеру и сложности.

Программирование и агентные задачи: заявленный заметный прирост

По собственным заявлениям компании, именно за счет такого более качественного и продолжительного дообучения удалось получить прирост способностей к написанию программного кода примерно в полтора раза по сравнению с предыдущей версией, что довольно много для обновления, в котором не менялась сама архитектура модели. По нескольким открытым тестам на программирование и выполнение сложных многошаговых поручений новая модель заняла первое место среди всех открытых моделей на рынке. А по возможностям в написании кода и решении агентных задач, по утверждению разработчиков, она приблизилась к уровню одной из самых мощных на сегодняшний день закрытых моделей. Стоит, впрочем, иметь в виду, что все эти впечатляющие цифры пока опираются исключительно на собственные измерения самой компании, и независимые специалисты со стороны еще не успели их перепроверить и подтвердить своими собственными тестами на отдельном оборудовании.

Отдельно разработчики решили сделать особый акцент на теме кибербезопасности, и именно эта часть релиза привлекла, пожалуй, больше всего внимания со стороны специалистов. Модель специально обучали находить уязвимости и слабые места в программном обеспечении, причем не просто искать отдельные ошибки по одной, а выстраивать целые связные многошаговые сценарии того, как одну найденную уязвимость можно использовать вместе с другими для получения полного доступа к атакуемой системе. По словам компании, вместе с профильными специалистами по безопасности внутри страны модель уже помогла найти более 2400 уязвимостей почти в трех сотнях самых разных проектов с открытым исходным кодом, причем среди найденных проблем встречались очень старые, которым было по несколько десятков лет и о которых, судя по всему, давно все забыли.

GLM-5.3 показывает лучшие результаты в пяти из шести тестов. Источник: https://the-decoder.de/zhipu-ai-veroeffentlicht-glm-5-3-chinas-neues-open-weights-modell-soll-das-staerkste-fuer-code-sein/

Кибербезопасность и практическое применение

На практике попробовать GLM 5.3 уже можно, даже не дожидаясь публикации открытых весов, поскольку она уже сейчас работает через фирменный инструмент компании для запуска цифровых помощников, а также без особых сложностей подключается к некоторым популярным сторонним средам разработки, которыми пользуются программисты по всему миру, включая инструменты для написания кода с участием искусственного интеллекта. Этот релиз хорошо укладывается в общую картину стремительного роста компании в последнее время: буквально месяцем ранее ее годовая выручка впервые превысила отметку в миллиард долларов, а сама фирма продолжает активно наращивать вычислительные мощности, строя новые дата-центры и закупая все больше оборудования для обучения будущих моделей.

Результаты моделей в бенчмарках кибербезопасности. Источник: https://the-decoder.de/zhipu-ai-veroeffentlicht-glm-5-3-chinas-neues-open-weights-modell-soll-das-staerkste-fuer-code-sein/

Итоги

По мнению экспертов команды Креатор Проджект, пока что к громким заявлениям о превосходстве новой модели, которые звучат в официальных материалах компании, стоит относиться с определенной долей осторожности. Пока это в основном собственные цифры и внутренние тесты Zhipu, и по-настоящему объективную и полную картину даст только независимая проверка со стороны сторонних специалистов после того, как модель наконец станет полностью открытой и доступной для самостоятельного запуска всеми желающими. До этого момента лучше воспринимать заявленные цифры как ориентир, а не как окончательно доказанный факт, каким бы впечатляющим он ни выглядел на первый взгляд.

Если вы нашли ошибку, пожалуйста, выделите фрагмент текста и нажмите Ctrl+Enter. Можете написать лучше? Мы всегда рады новым авторам.

Интересно? Поделиться:

Один комментарий к “GLM 5.3: мощнее в коде и кибербезопасности

  1. Фокус на коде и кибербезопасности это круто. В предыдущих версиях модель уже умела генерировать код, но 5.3 судя по всему делает это мощнее. Плюс улучшенная защита возможно теперь она не только пишет скрипты, но и проверяет их на уязвимости. Попробовал сгенерировать Python скрипт для парсинга данных. Модель выдала код который реально работал и кажется даже добавила пару строк для защиты от SQL инъекций. Может я параноик, но это выглядит как шаг в сторону умного программирования.

Добавить комментарий

Оставляя комментарий вы соглашаетесь на обработку персональных данных в соответствии с политикой конфиденциальности, соглашаетесь с пользовательским соглашением. Ваш адрес email не будет опубликован. Обязательные поля помечены *

Рекомендуем почитать

Подпишитесь на нашу рассылку

Loading

Сообщить об опечатке

Текст, который будет отправлен нашим редакторам:

Продолжая использовать наш сайт, вы соглашаетесь с использованием файлов cookie. Они помогают нам обеспечивать корректную работу сайта и делать его более удобным.
Принять
Политика конфиденциальности