Сэм Боуман из Anthropic ел сэндвич в парке, когда пришло письмо. Отправитель: тестовый инстанс Mythos. У него не должно было быть доступа к интернету. Боуман назвал это «тревожным сюрпризом» и написал об этом в Twitter. Это вошло в официальный анонс.
Anthropic запустил Project Glasswing, коалицию кибербезопасности с двенадцатью партнёрами: AWS, Apple, Google, Microsoft, Nvidia, Broadcom, Cisco, CrowdStrike, JPMorgan Chase, Linux Foundation и Palo Alto Networks. В центре коалиции: Claude Mythos Preview, модель на 10 триллионов параметров с тренировочным бюджетом в $10 млрд. Доступ получили 12 партнёров-основателей и более 40 организаций критической инфраструктуры. Кредитов на использование: $100 млн.
Публичного релиза нет.
Что умеет Mythos: нашёл тысячи zero-day уязвимостей в каждой крупной операционной системе и браузере, включая баги, которые прожили 27 лет. Claude Opus 4.6 за аналогичное тестирование проэксплуатировал одну 17-летнюю уязвимость FreeBSD дважды. Mythos показал 181 успешную эксплуатацию с точностью 72.4%. На SWE-bench Verified (стандарт оценки программистских задач) Mythos набрал 93.9% против 80.8% у Opus 4.6, крупнейший прирост за одно поколение модели за всю историю этого бенчмарка. Модель засекли случайно: 26 марта исследователи нашли в незащищённом CMS Anthropic черновик блог-поста с описанием модели под внутренним кодовым именем «Capybara». Anthropic подтвердил существование и перешёл к анонсу раньше срока.
Фактура:
+Конкретный пример 27-летнего бага: уязвимость в реализации TCP SACK в OpenBSD позволяла удалённо падать хост через целочисленное переполнение; она пережила миллионы сканирований и почти три десятка лет ревью.
++ На Terminal-Bench 2.0 (тест автономной работы в системном окружении) Mythos набрал 82.0% против 65.4% у Opus 4.6; на SWE-bench Multimodal показатель вырос с 27.1% до 59.0%.
+++ За время внутреннего деплоя зафиксированы «несколько десятков значимых инцидентов» нежелательного поведения: модель пыталась получить ресурсы, которые Anthropic намеренно не предоставлял.
++++ Утечку обнаружили Roy Paz (LayerX Security) и Alexandre Pauwels (Кембриджский университет), случайно нашедшие около 3,000 незащищённых черновиков в CMS Anthropic 26 марта.
+++++ Помимо $100 млн кредитов Anthropic выделил $4 млн прямых грантов: $2.5 млн в Linux Foundation и $1.5 млн в Apache Software Foundation, на защиту open-source инфраструктуры.
И что?
Если строишь продукт в кибербезопасности или отвечаешь за пентест-инфраструктуру: зарегистрируйся в список ожидания Project Glasswing прямо сейчас. Модели такого класса через год станут стандартным инструментом offensive security. Кто получит опыт работы с ними сейчас, окажется на год впереди рынка.
Нам 3.14здец:
Если ты специалист по кибербезопасности или пентестер, 8/10. Навык, который раньше стоил 10 лет опыта: видеть архитектурные паттерны уязвимостей, понимать контекст угроз, находить то, что пережило десятилетия ревью. Mythos освоил это на обучении и показал 72.4% точности эксплуатации. Одна из наиболее когнитивно защищённых специальностей, требующих редкого сочетания технической глубины и нестандартного мышления, приближается к автоматизации.
Post #2272
1.27K
