TGViewer
OMG GPT: Midjourney, DeepSeek, IT OMG GPT: Midjourney, DeepSeek, IT @omggpt · 4.15K subscribers
Post #5869 108
Anthropic проверила GLM-5.3 — открытая китайская модель уже умеет искать и эксплуатировать уязвимости

Anthropic впервые отдельно оценила открытую китайскую модель и выпустила исследование о кибервозможностях GLM-5.3 от Z.ai.

Модель вышла в августе, а через две недели Z.ai открыла веса. И именно это делает историю чувствительной: речь не о закрытой системе в лаборатории, а о модели, которую можно скачать и запускать самостоятельно.

За две недели до Anthropic её проверял CAISI — центр стандартов и инноваций ИИ при американском NIST. Там GLM-5.3 назвали одной из самых сильных открытых моделей в киберзадачах на сегодня.

По данным Anthropic, в ExploitBench модель смогла довести известные уязвимости движка V8 до рабочего эксплойта в 50 попытках из 410 — это около 12%.

Для сравнения:
— Claude Mythos Preview — 14%
— GLM-5.2 — близко к нулю
— Claude Opus 4.6 — тоже около нуля

В ручных сессиях с человеком GLM-5.3 находила ранее неизвестные уязвимости в браузере и драйверах. При этом, по утверждению Anthropic, встроенные ограничения обходятся сравнительно легко, а в версии с открытыми весами их можно убрать совсем.

CAISI описывает картину осторожнее.

На четырёх кибербенчмарках GLM-5.3 всё ещё заметно уступает американским frontier-моделям. Например, в SEC-Bench Pro она решает 40,4% задач против 90,2% у передовых закрытых систем.

Совокупное отставание CAISI оценивает примерно в 4 месяца.

Но главный вывод у Anthropic и CAISI сходится: возможности, которые ещё год назад были доступны в основном закрытым лабораториям, теперь начинают появляться у открытых моделей.

Anthropic предлагает в ответ шире открывать сильные модели для специалистов по безопасности и проверять достаточно мощные системы до релиза уже на государственном уровне.

Z.ai пока публично не ответила ни на исследования, ни на инициативу Anthropic.

Исследование Anthropic:
https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities
Оценка CAISI:
https://www.nist.gov/news-events/news/2026/09/caisis-assessment-zais-glm-53-cyber-capabilities
Anthropic GLM-5.3 and the spread of advanced cyber capabilities GLM-5.3 can autonomously build end-to-end cyber exploits, but unlike other frontier models, it was released without meaningful safeguards to limit misuse.
More from @omggpt
  1. Sep 30, 2026Цифровая муха теперь помогает выбирать, с какой задачи начать Коннектом дрозофилы нашёл не…
  2. Sep 30, 2026OpenAI уже смотрит за горизонт GPT-6 — основные исследования ушли в GPT-7 и GPT-8 Глава Ap…
  3. Sep 30, 2026В Иннополисе сделали ИИ-фреймворк для поиска молекул по их «отпечатку» Исследователи Униве…
  4. Sep 30, 2026Ozon Tech выложил доклады про ML в маркетплейсах Ozon Tech провёл конференцию E-CODE ко Дн…
  5. Sep 29, 2026Gemini сможет сам звонить в компании и пробираться через IVR-меню Google тестирует функцию…
  6. Sep 29, 2026ElevenLabs выкатила Eleven v4 и v4 Turbo — озвучка теперь не просто читает, а играет Тепер…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →