За даними компанії, у симуляційних тестах захисні обмеження моделі від Zhipu AI вдавалося обходити у 64–100% випадків. На тестовому наборі ExploitBench вона успішно створила засоби використання вразливостей у 50 із 410 спроб — результат, близький до Claude Mythos Preview від Anthropic.
Під час окремого експерименту за участю фахівця GLM-5.3 за день знайшла раніше невідомі проблеми в JavaScript-рушії браузера та об’єднала їх у робочий експлойт. Частину інших знахідок ще перевіряють.
Anthropic попереджає, що такі можливості без належних запобіжників можуть посилити зловмисників, і закликає розширювати доступ до передового ШІ для кіберзахисників.
ДМ | ДМ WhatsApp | ДМ Viber
