Z.ai выпустила GLM-5.3: прирост дало только дообучение, веса обещают позже

Z.ai обновила свою открытую модель для кода GLM-5.3, и базовая модель в ней та же, что в GLM-5.2. Весь прирост компания получила на этапе после предобучения: больше сред, где модель реально запускает код, более длинные задачи, более строгие проверяющие и больше обучения с подкреплением — когда модель учится на оценке своих же попыток.
Сильнее всего изменился поиск уязвимостей: на бенчмарке ExploitBench доля решённых задач выросла с 24,4% до 54,4%, а в ExploitGym модель за два часа закрыла 105 задач против 29. На Terminal Bench, где агент работает в командной строке, результат вырос примерно в шесть раз, и при этом на рассуждения уходит меньше токенов. Z.ai заявляет, что с релиза предыдущей версии её модели нашли около 2,5 тысячи уязвимостей, а самой старой из них 45 лет.
Инженер Делип Рао сообщил, что GLM-5.3 нашла двадцать уязвимостей высокого и критического уровня в популярном агенте Hermes от Nous Research. В API модели пока нет — доступ только через подписку GLM Coding Plan и редактор ZCode, веса обещают выложить через две недели.