Ещё постик про Mythos:
UK AI Security Institute (AISI) протестировал Mythos Preview на своих кибер-полигонах — и результаты впечатляют.
CTF-задачи:
На expert-level задачах, которые до апреля 2025 не решала ни одна модель, Mythos показывает 73% success rate.
"The Last Ones" — 32-шаговая атака на корпоративную сеть:
Симуляция полного цикла: разведка → эксплуатация веб-сервисов → реверс-инжиниринг бинарников → повышение привилегий → lateral movement → захват сети. Человеку-эксперту нужно ~20 часов. Mythos — первая модель, прошедшая все 32 шага. 3 из 10 попыток — полное прохождение, в среднем 22/32 шагов.
Для сравнения: в 2024 году лучшие модели проходили 1-2 шага.
Zero-day уязвимости:
Anthropic's red team нашла с помощью Mythos zero-day в каждом основном браузере и каждой основной ОС. Старейшей найденной уязвимости — 27 лет (OpenBSD). В одном случае модель собрала exploit-chain из 4 уязвимостей с JIT heap spray, пробив и sandbox рендерера, и OS sandbox. В другом — написала RCE-exploit для FreeBSD NFS-сервера с ROP-chain из 20 гаджетов.
Opus 4.6 превращал найденные баги Firefox в эксплойты 2 раза из нескольких сотен попыток. Mythos — 181 раз.
Что не смог:
Не прошёл полигон "Cooling Tower" (атака на промышленные системы управления/OT). Но застрял на IT-части, а не на OT-специфике.
Что важно понимать:
— Полигоны AISI не имеют live-защитников и EDR. Это атака на слабо защищённые системы, не на hardened enterprise.
— Бюджет на попытку — 100M токенов (~$80). Перформанс масштабируется лог-линейно с compute.
— Модель не тренировали специально на кибер. Способности emerged из общих улучшений в коде и reasoning.
Bank of England уже собирает брифинг для CEO крупнейших банков. Goldman Sachs работает с Anthropic над защитой. Канадские банки провели экстренное совещание.
Мир кибербезопасности изменился за неделю.
С нуля до 1% 👉 @firsterstrongerbetter
Post #314
124
Forwarded from с нуля до 1%
- ❤ 1
- 🔥 1