TGViewer
Kali Linux Kali Linux @linuxkalii · 55.5K subscribers
Post #2231 2.76K

Forwarded from Machinelearning

📌 Anthropic оценила кибервозможности GLM-5.3

Anthropic впервые оценила открытую китайскую модель и опубликовала исследование о том, насколько GLM-5.3 от Z.ai продвинулась в поиске и эксплуатации уязвимостей.

Z.ai выпустила модель в августе, веса выложила через две недели.


Двумя неделями ранее её проверял CAISI, центр стандартов и инноваций ИИ при американском институте NIST, и назвал сильной в киберзадачах среди открытых моделей на сегодня.

По словам Anthropic, в ExploitBench GLM-5.3 довела до рабочего эксплойта известные уязвимости движка V8 в 50 попытках из 410, это 12%.

У Claude Mythos Preview результат 14%, у GLM-5.2 и Claude Opus 4.6 близок к нулю.


В ручных сессиях с человеком модель находила ранее неизвестные уязвимости в браузере и драйверах, а встроенные ограничения, утверждает Anthropic, обходятся без особых усилий и в открытых весах их можно снять.

🟡CAISI более сдержан в описании результатов

На четырёх кибербенчмарках GLM-5.3 заметно слабее американских передовых моделей, в SEC-Bench Pro она решает 40,4% задач против 90,2%.

Совокупное отставание CAISI оценивает примерно в четыре месяца.

Вывод обеих организаций совпадает в главном - возможности, которые год назад были только у закрытых лабораторий, теперь доступны любому, кто скачает веса.

В ответ на это Anthropic предлагает шире открывать передовые модели для безопасников и проверять достаточно сильные модели до выпуска на уровне государств.

Z.ai пока никак не отреагировала ни на оба исследования, ни на инициативу Anthropic.


@ai_machinelearning_big_data

#news #ai #ml
  • 🔥 9
  • ❤ 5
  • 👍 2
More from @linuxkalii
  1. Sep 30, 2026Почему `kill -9` не может убить главный процесс Linux Обычно SIGKILL завершает любой проце…
  2. Sep 28, 2026Linux приближается к 2000 уязвимостей за один релиз Ещё несколько лет назад речь шла приме…
  3. Sep 28, 2026🚨 Claude-Red: библиотека навыков для пентестов с Claude. В репозитории собраны файлы SKIL…
  4. Sep 27, 2026🚨 OpenAI и Anthropic расследуют уже не десятки, а десятки тысяч проблемных эпизодов с AI-…
  5. Sep 26, 2026🚨 Claude выкинули из оборонной цепочки США и суд поддержал Пентагон История вокруг Anthro…
  6. Sep 24, 2026🚨 Сообщают о возможном взломе Bitget на $170 млн. По предварительным данным, активы на су…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →