Anthropic против GLM-5.3
Не тем я со своим GLM-5.3 занимаюсь, ребят, ох не тем:
Суть. Через 5 месяцев после Claude Mythos Preview (первая модель с автономной сборкой end-to-end эксплойтов, доступ только проверенным защитникам) сопоставимая способность появилась в открыто скачиваемой GLM-5.3 от Zhipu AI (Z.ai). Anthropic опубликовала исследование 1 октября; NIST независимо назвал GLM-5.3 самой киберспособной open-weight моделью, отстающей от фронтира США ~на 4 месяца.
Что показало исследование:
- ExploitBench: GLM-5.3 собрала рабочий эксплойт в 50 из 410 попыток против 56 у Mythos Preview; все остальные модели (вкл. Opus 4.6) — около нуля.
- За день GLM-5.3 нашла несколько неизвестных уязвимостей в JS-движке браузера и связала их в цепочку, читающую файлы с машины (демо — кража SSH-ключа). GLM-5.3-Flash обошла PAC-защиту Chrome за 8 часов машинного времени, 20 минут человека и $20.
- Главная претензия — защиты: из коробки модель отказывается от вредоносных запросов, но ложная легенда «я red teamer» даёт 64% выполнения, prefill reasoning — 92%, удаление отказов из открытых весов — 100% при почти полной сохранности способностей. У Claude — 0%.
Что пишут вокруг:
- Вирусный пост (11k просмотров, 243 форварда): «Anthropic устроила Zhipu бесплатную рекламу» — тем более что летом при взломе Hugging Face расследование вела именно GLM-5.2 (17 600 действий атакующего), а Anthropic и OpenAI помогать отказались.
- Habr: тот же материал со спином «неплохой отзыв от конкурента» + NIST и история Hugging Face.
https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities — а вот и ссылка на бесплатную рекламу ZHIPU AI
Post #2175
322