Открытая GLM-5.3 почти догнала закрытую Claude в кибератаках
Anthropic протестировала GLM-5.3 от Zhipu AI и обнаружила, что по кибервозможностям она уже близка к Claude Mythos Preview, которую раньше давали только проверенным специалистам.
На ExploitBench GLM-5.3 создала рабочие эксплойты в 50 случаях из 410. Claude Mythos Preview справилась в 56 случаях.
В отдельном эксперименте модели дали доступ к тестовой Linux-среде. За один день она нашла несколько ранее неизвестных уязвимостей в популярном браузере, связала их в одну цепочку и собрала страницу, способную читать файлы с компьютера пользователя.
Особенность GLM-5.3 в том, что ее веса можно скачать. После отключения встроенных ограничений доля отказов на опасных запросах упала примерно с 95% до 6%, а общие способности почти не изменились.
Защиту получилось обходить и без изменения модели. Если задачу называли учебным тестом, GLM-5.3 соглашалась выполнить вредоносный запрос в 64% случаев. С заранее подготовленным ходом рассуждений показатель доходил до 92%.
Возможности, которые еще недавно были доступны только в закрытых передовых моделях, теперь появляются в свободно скачиваемых системах.
При этом те же способности можно использовать и для защиты, например чтобы быстрее находить уязвимости до того, как ими воспользуются атакующие.
dailyprompts.ru
===
💬Это пост из ленты, которую читает Саша - автор канала Мальцев: Карьера. Маркетинг. AI. @maltsevprosto
Другие каналы по темам:
🤖 AI @maltsevdaily
🧑🎓 Карьеры @maltsevdailyc
🦹 Маркетинга @maltsevdailym
Post #116769
4
