🅰️ Вышла GLM-5.3
Модель использует ту же базу, что GLM-5.2, а весь прирост дала пост тренировка (дообучение уже готовой базы) для сложного агентного кодинга, длинных задач и поиска уязвимостей.
Модель уже доступна всем подписчикам GLM Coding Plan. Он перешёл на балльную квоту. Расход баллов теперь зависит от времени: вне пиковых часов (всё время, кроме будней с 09:00 до 13:00 по МСК) генерация стоит на 50% дешевле.
Веса выложат через 2 недели после оценки безопасности и усиления защиты.
💠 PERCEPTRON.
Модель использует ту же базу, что GLM-5.2, а весь прирост дала пост тренировка (дообучение уже готовой базы) для сложного агентного кодинга, длинных задач и поиска уязвимостей.
— Модель сильно прибавила в автономном кодинге. На Terminal Bench 3.0 результат вырос с 4.6 до 28.3. При этом на сложных задачах GLM-5.3 расходует меньше токенов, чем прошлая версия.
— На CyberGym (бенчмарк поиска уязвимостей) GLM-5.3 набрала 84,5% и заняла 1 место. Она научилась выстраивать длинные цепочки эксплойтов и в реальных тестах уже нашла 2436 багов в опенсорсных проектах (самой старой уязвимости было 40 лет).
— На ExploitGym (бенчмарк эксплуатации уязвимостей) модель выполнила 105 задач за 2 часа и 130 за 6 против 29 и 39 у GLM-5.2.
— В API есть 3 уровня reasoning_effort — low, high и max. Отключить thinking больше нельзя — такой запрос завершится ошибкой.
Модель уже доступна всем подписчикам GLM Coding Plan. Он перешёл на балльную квоту. Расход баллов теперь зависит от времени: вне пиковых часов (всё время, кроме будней с 09:00 до 13:00 по МСК) генерация стоит на 50% дешевле.
Веса выложат через 2 недели после оценки безопасности и усиления защиты.
💠 PERCEPTRON.