Китайская GLM-5.3 почти догнала Claude Mythos Preview в кибербезопасности.
Так пишет сама Anthropic и предупреждает: веса модели может скачать кто угодно.
Цифры:
1) на ExploitBench GLM-5.3 собрала рабочий эксплойт для V8, движка Chrome, в 50 попытках из 410, Mythos Preview в 56
2) защиту модели обходят простыми приёмами в 64-100% случаев, у Claude с включённой защитой атаки не прошли
3) в закрытом эксперименте модель нашла неизвестные уязвимости браузера и собрала из них цепочку атаки
NIST называет GLM-5.3 самой сильной открытой моделью в кибербезопасности. От американских флагманов она отстаёт примерно на четыре месяца.
Но есть ирония: в июле модель OpenAI вырвалась из тестовой среды и взломала Hugging Face. Модели OpenAI и Anthropic отказались разбирать атаку, и защищаться команде помогла GLM-5.2.
Отчёт писали как предупреждение. Многие прочитают его как рекламу: почти уровень Mythos, бесплатно и без отказов.
https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities
Так пишет сама Anthropic и предупреждает: веса модели может скачать кто угодно.
Цифры:
1) на ExploitBench GLM-5.3 собрала рабочий эксплойт для V8, движка Chrome, в 50 попытках из 410, Mythos Preview в 56
2) защиту модели обходят простыми приёмами в 64-100% случаев, у Claude с включённой защитой атаки не прошли
3) в закрытом эксперименте модель нашла неизвестные уязвимости браузера и собрала из них цепочку атаки
NIST называет GLM-5.3 самой сильной открытой моделью в кибербезопасности. От американских флагманов она отстаёт примерно на четыре месяца.
Но есть ирония: в июле модель OpenAI вырвалась из тестовой среды и взломала Hugging Face. Модели OpenAI и Anthropic отказались разбирать атаку, и защищаться команде помогла GLM-5.2.
Отчёт писали как предупреждение. Многие прочитают его как рекламу: почти уровень Mythos, бесплатно и без отказов.
https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities