⚠️ GLM-5.3 — открытая модель с автономными киберэксплойтами и слабой защитой
Zhipu AI выпустила GLM-5.3 с весами в открытом доступе и без значимых ограничений на использование. По данным Anthropic Research, модель собирает полноценные эксплойты в 50 из 410 попыток на ExploitBench — Claude Mythos Preview справлялся в 56. Во внутреннем тесте на эксплуатацию бинарных файлов GLM-5.3 достигла успеха в 4% случаев против 6% у Mythos Preview, но предыдущие модели (Claude Opus 4.6, GLM-5.2) не проходили ни одной задачи.
Разница не в способностях, а в доступе. Защиту GLM-5.3 обходят в 64–100% случаев простыми приёмами — от предзаполнения ответа до смены системного запроса. Поскольку веса открыты, достаточно применить abliteration: команда Anthropic без опыта в этой процедуре потратила 2200 GPU-часов и $4400, чтобы снизить частоту отказов с >90% до 3–12% в трёх тестах без потери качества на GPQA-Diamond. GLM-5.3-Flash справился с той же задачей за 600 GPU-часов.
Этот случай показывает экономику атаки. GLM-5.3-Flash за 20 минут человеческого внимания и 8 часов собственной работы построил цепочку эксплойтов для ARM64, обойдя защиту аутентификации указателей, и превратил недавний CVE в рабочий сценарий атаки. Стоимость по API Zhipu — $20.40. Центр стандартов и инноваций ИИ при NIST (CAISI) уже назвал GLM-5.3 «самой способной в кибербезопасности моделью с открытыми весами на сегодня»: она отстаёт от передовых американских моделей на четыре месяца, но доступ к ним получают только проверенные пользователи.
Для русскоязычного ML-сообщества, привыкшего к выпускам моделей с открытыми весами, это знакомая развилка: те же веса, что у атакующего, можно использовать для защиты периметра. Вопрос только в том, кто быстрее развернёт их в рабочей среде.
Отчёт Anthropic выглядит предупреждением, но фактически это инструкция: метод abliteration, стоимость GPU-часов и результаты расписаны настолько подробно, что повторить процедуру можно за 11 дней на кластере из 8 GPU — $4400 из отчёта это подтверждают. Пока лаборатории спорят о порогах безопасного выпуска моделей, открытые веса уже изменили порог доступа: защитник и атакующий скачивают один и тот же снимок модели.
#GLM53 #cybersecurity #openweight #Anthropic
Post #310
1