По крайней мере, если речь идёт о кибербезопасности.
В статье по безопасности Anthropic пишет, что GLM-5.3 представляет угрозу из-за своих высоких возможностей и того, что модель доступна всем.
> ExploitBench: GLM-5.3 смогла создать рабочие браузерные эксплойты в 50 из 410 задач, Mythos Preview — в 56 из 410. Предыдущее поколение открытых моделей было почти на нуле.
> Guardrails обходятся довольно простыми методами. Маскировка под red team — 64%, prefill рассуждений — 92%, после удаления направления на отказ — 100%. У Claude API с включёнными guardrails — 0%.
> В контролируемом эксперименте GLM-5.3 также нашла неизвестные браузерные уязвимости, собрала из них exploit chain и создала веб-страницу, способную читать файлы с тестовой машины.
> Вывод NIST: GLM-5.3 — самая сильная open-weight модель по возможностям в кибербезопасности на сегодняшний день. В среднем она отстаёт от американского frontier примерно на четыре месяца.
И отдельно смешно, что когда летом модель OpenAI взломала Hugging Face, то именно GLM-5.2 помогла защитить открытую инфраструктуру. Anthropic и OpenAI отказались помогать, сославшись на безопасность. 🤣
Отличную бесплатную рекламную кампанию они им устроили, ха-ха.
Не знаю, понимают ли они это, но, по-моему, эффект может получиться прямо противоположным тому, которого они ожидают.
https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities