Anthropic проверила GLM-5.3 — открытая китайская модель уже умеет искать и эксплуатировать уязвимости
Anthropic впервые отдельно оценила открытую китайскую модель и выпустила исследование о кибервозможностях GLM-5.3 от Z.ai.
Модель вышла в августе, а через две недели Z.ai открыла веса. И именно это делает историю чувствительной: речь не о закрытой системе в лаборатории, а о модели, которую можно скачать и запускать самостоятельно.
За две недели до Anthropic её проверял CAISI — центр стандартов и инноваций ИИ при американском NIST. Там GLM-5.3 назвали одной из самых сильных открытых моделей в киберзадачах на сегодня.
По данным Anthropic, в ExploitBench модель смогла довести известные уязвимости движка V8 до рабочего эксплойта в 50 попытках из 410 — это около 12%.
Для сравнения:
— Claude Mythos Preview — 14%
— GLM-5.2 — близко к нулю
— Claude Opus 4.6 — тоже около нуля
В ручных сессиях с человеком GLM-5.3 находила ранее неизвестные уязвимости в браузере и драйверах. При этом, по утверждению Anthropic, встроенные ограничения обходятся сравнительно легко, а в версии с открытыми весами их можно убрать совсем.
CAISI описывает картину осторожнее.
На четырёх кибербенчмарках GLM-5.3 всё ещё заметно уступает американским frontier-моделям. Например, в SEC-Bench Pro она решает 40,4% задач против 90,2% у передовых закрытых систем.
Совокупное отставание CAISI оценивает примерно в 4 месяца.
Но главный вывод у Anthropic и CAISI сходится: возможности, которые ещё год назад были доступны в основном закрытым лабораториям, теперь начинают появляться у открытых моделей.
Anthropic предлагает в ответ шире открывать сильные модели для специалистов по безопасности и проверять достаточно мощные системы до релиза уже на государственном уровне.
Z.ai пока публично не ответила ни на исследования, ни на инициативу Anthropic.
Исследование Anthropic:
https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities
Оценка CAISI:
https://www.nist.gov/news-events/news/2026/09/caisis-assessment-zais-glm-53-cyber-capabilities
Post #5869
108