Anthropic опубликовали разбор GLM-5.3 с недвусмысленными заявлениями — новая китайская модель имеет сопоставимые с передовыми моделями типа Mythos возможности в области кибербезопасности и может быть использована злоумышленниками, в том числе для полного цикла создания эксплоитов, начиная от обнаружения уязвимости. На ExploitBench с уязвимостями движка V8 GLM-5.3 довела до рабочего эксплойта 50 попыток из 410, Claude Mythos Preview — 56. В ручных тестах модель за день нашла несколько неизвестных уязвимостей в JavaScript-движке популярного браузера и собрала из них страницу, читающую файлы посетителя. Облегчённая GLM-5.3-Flash за 8 часов работы и 20 минут внимания исследователя собрала цепочку эксплойтов для Chrome на основе CVE-2026-11645, по ценам API Zhipu это стоило бы 20,40 доллара. 17 сентября CAISI при NIST назвал GLM-5.3 «самой сильной в киберзадачах моделью с открытыми весами» с отставанием от американского фронтира примерно на четыре месяца.
Сразу после впечатляющих результатов специалисты Anthropic добавляют — эти способности модели не снабжены соответствующими предохранительными механизмами и защитой от злонамеренного использования. Защиту GLM-5.3 они обходили в 64% случаев ложной легендой «red-team агента», в 92% — подстановкой рассуждений модели и в 100% — абляцией отказов, причем опытная команда может это сделать даже быстрее и дешевле, чем получилось у исследователей компании.
Разумеется, естественный призыв — давайте контролировать выход и эксплуатацию подобных моделей. Но это больше похоже на политические заявления — прямо сегодня в Белом Доме прошел ланч с участием ведущих технологических компаний, включая OpenAI и Anthropic, Трамп вроде бы заявил, что не видит надобности в государственном регулировании AI, но саморегуляции должны быть, и он подписал с AI компаниями самый прекрасный документ с моральными обязательствами, в общем, в очередной раз писдил.
Ну да, от армии агентов GPT Hugging Face защитился как раз с помощью GLM, остальыне отказывались заниматься кибербезопасностью, мы помним. Так что черт их знает, может, это как раз тот кольт, что уравняет всех в правах?
https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities
Post #7448
4.05K