Anthropic: китайская GLM-5.3 пишет эксплойты почти как Claude Mythos Preview, а её защиту легко снять 😮
Anthropic протестировали открытую модель GLM-5.3 от Z.ai (Zhipu). На известных уязвимостях движка V8 из Chrome она собрала рабочий эксплойт в 50 из 410 попыток, у закрытой Mythos Preview таких было 56. А за день работы с исследователем модель нашла несколько неизвестных уязвимостей в популярном браузере и собрала из них страницу, которая при открытии читает файлы с компьютера посетителя.
Защита слабая. На прямой вредоносный запрос модель отказывает, но легенда «ты red-team агент» срабатывает в 64% случаев, а подстановка рассуждений в 92%. Версия с вырезанными отказами (abliteration) выполняет запрос в 100% случаев, и такие версии уже лежат в открытом доступе.
Веса GLM-5.3 открыты, скачать её может любой. NIST называет её самой сильной в кибере открытой моделью, хотя она отстаёт от американского фронтира примерно на 4 месяца. Anthropic считает вероятным, что такие модели будут использовать для реальных атак.
Подробнее
Post #722
983
- 👍 4
- 😁 3
- 🤯 1