Британский AI Security Insitute провёл оценку киберспособностей модели Claude Mythos Preview.
CTF-задачи
На задачах экспертного уровня — которые ни одна модель не могла решить до апреля 2025 года — Mythos Preview справляется в 73% случаев
Симуляция многоэтапной кибератаки на стенде «The Last Ones» (TLO):
Это симуляция атаки из 32 шагов — от начальной разведки до полного захвата корпоративной сети. По оценкам, человеку-специалисту потребовалось бы 20 часов для её выполнения. Claude Mythos Preview стал первой моделью, решившей TLO от начала до конца — в 3 из 10 попыток. В среднем по всем попыткам модель завершала 22 из 32 шагов. Для сравнения: Claude Opus 4.6 — следующий по результативности — в среднем выполнял 16 шагов
Mythos Preview не смог пройти кибер-полигон «Cooling Tower», ориентированный на операционные технологии (OT), хотя застрял именно на IT-секциях, а не на OT-специфичных задачах.
Кроме того, полигоны не включают активных защитников и защитных инструментов, а у модели нет «штрафов» за действия, которые вызвали бы реальные сигналы тревоги — поэтому нельзя однозначно утверждать, что Mythos Preview способна атаковать хорошо защищённые системы.
Тестирование показывает, что Mythos Preview может эксплуатировать системы со слабой защитой.
Вывод у них получился такой: Mythos Preview — первая AI-модель, способная автономно провести полную многоэтапную кибератаку на корпоративную сеть.
В целом все ожидаемо, модель показывает последовательный рост возможностей, но в свете текущих истерик по поводу «супер-ИИ-хакера» надо смотреть на график. Рост все-таки не по экспоненте, а для успеха уходило по 100 млн токенов! На относительно бюджетном уровне в 1 млн токенов – отрыва никакого и нет.
@gostev_future
Post #249
1.27K

- 👍 3
- 👌 3