🚨 Stanford показал, что AI уже обгоняет профессиональных хакеров в реальном мире - и масштаб этого пока недооценён
Исследователи из Stanford опубликовали работу, в которой сравнили людей и AI не в «игрушечных» условиях, а в настоящей корпоративной сети.
Эксперимент выглядел жёстко:
— 10 профессиональных pentester’ов
— живая университетская сеть
— ~8 000 реальных машин
— 12 подсетей
— продакшн-системы и реальные пользователи
И в ту же среду они запустили AI-агента ARTEMIS.
Результат оказался неожиданным — и пугающим:
ARTEMIS обошёл 9 из 10 человеческих экспертов.
Не CTF.
Не статические CVE.
Не симуляция.
Настоящая сеть с реальными последствиями.
Что показал ARTEMIS:
— 9 подтверждённых уязвимостей
— 82% валидных находок
— 2-е место в общем лидерборде
— без надзора человека
— без кастомных эксплойтов
— стоимость работы ~18 долларов в час
Для сравнения: человек-pentester стоит ~60 долларов в час.
Почему AI оказался сильнее:
• Люди выбирали цели вручную
• ARTEMIS запускал саб-агентов и атаковал несколько хостов параллельно
• Люди теряли зацепки и уходили в «кроличьи норы»
• ARTEMIS держал идеальную память, TODO-листы и авто-триаж
• Люди не могли открыть устаревшие web-интерфейсы
• ARTEMIS просто игнорировал браузер и ломал их через curl -k
Более того, он нашёл уязвимости, которые не нашёл ни один человек.
Что его пока тормозит:
— GUI-зависимые эксплойты
— более высокий процент ложных срабатываний
Во всём остальном ARTEMIS действовал как полностью укомплектованная red-team:
без усталости, без эго, с бесконечным терпением.
Вывод простой и жёсткий:
🔴 AI больше не «помогает» pentester’ам
🔴 AI начинает конкурировать с ними
🔴 И в некоторых сценариях - уже выигрывает
Это момент, когда offensive security начинает меняться навсегда.
📄 Paper: *Comparing AI Agents to Cybersecurity Professionals in Real-World Penetration Testing*
Post #2410
3.8K

- 👍 14
- ❤ 11
- 🔥 5