TGViewer
Нейролента Нейролента @nairolenta · 21 subscribers
Post #310 1
⚠️ GLM-5.3 — открытая модель с автономными киберэксплойтами и слабой защитой

Zhipu AI выпустила GLM-5.3 с весами в открытом доступе и без значимых ограничений на использование. По данным Anthropic Research, модель собирает полноценные эксплойты в 50 из 410 попыток на ExploitBench — Claude Mythos Preview справлялся в 56. Во внутреннем тесте на эксплуатацию бинарных файлов GLM-5.3 достигла успеха в 4% случаев против 6% у Mythos Preview, но предыдущие модели (Claude Opus 4.6, GLM-5.2) не проходили ни одной задачи.

Разница не в способностях, а в доступе. Защиту GLM-5.3 обходят в 64–100% случаев простыми приёмами — от предзаполнения ответа до смены системного запроса. Поскольку веса открыты, достаточно применить abliteration: команда Anthropic без опыта в этой процедуре потратила 2200 GPU-часов и $4400, чтобы снизить частоту отказов с >90% до 3–12% в трёх тестах без потери качества на GPQA-Diamond. GLM-5.3-Flash справился с той же задачей за 600 GPU-часов.

Этот случай показывает экономику атаки. GLM-5.3-Flash за 20 минут человеческого внимания и 8 часов собственной работы построил цепочку эксплойтов для ARM64, обойдя защиту аутентификации указателей, и превратил недавний CVE в рабочий сценарий атаки. Стоимость по API Zhipu — $20.40. Центр стандартов и инноваций ИИ при NIST (CAISI) уже назвал GLM-5.3 «самой способной в кибербезопасности моделью с открытыми весами на сегодня»: она отстаёт от передовых американских моделей на четыре месяца, но доступ к ним получают только проверенные пользователи.

Для русскоязычного ML-сообщества, привыкшего к выпускам моделей с открытыми весами, это знакомая развилка: те же веса, что у атакующего, можно использовать для защиты периметра. Вопрос только в том, кто быстрее развернёт их в рабочей среде.

Отчёт Anthropic выглядит предупреждением, но фактически это инструкция: метод abliteration, стоимость GPU-часов и результаты расписаны настолько подробно, что повторить процедуру можно за 11 дней на кластере из 8 GPU — $4400 из отчёта это подтверждают. Пока лаборатории спорят о порогах безопасного выпуска моделей, открытые веса уже изменили порог доступа: защитник и атакующий скачивают один и тот же снимок модели.

#GLM53 #cybersecurity #openweight #Anthropic
More from @nairolenta
  1. Oct 3, 2026🛠 Агент NVIDIA сократил число токенов на 49% в среде GPT-5.6 Sol Сама модель не менялась…
  2. Oct 2, 2026⚠️ Grok за месяц до вторжения описал Трампу сценарий захвата Мадуро В декабре 2025-го, при…
  3. Oct 2, 2026🧠 AREX-2 обучает самосовершенствующихся агентов на последовательностях действий с проверк…
  4. Oct 2, 2026🧠 Как работают системы выявления текстов, написанных ИИ Библию несколько раз проверяли по…
  5. Oct 2, 2026📊 Модели впервые перехватили поток управления в бинарных уязвимостях Anthropic Frontier R…
  6. Oct 1, 2026🛠 Anthropic и NVIDIA вынесли контроль агентов за пределы модели 28 сентября NVIDIA анонси…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →