TGViewer
PWN AI PWN AI @pwnai · 7.34K subscribers
Post #1246 996
Раньше считалось, что ханипоты отлично сбивают с толку автономных хакеров на базе ИИ. Логика была проста: у агента нет общей картины, он принимает ловушку за настоящую цель, тратит время впустую и не может нанести реального вреда.

Новое исследование Rouxii: Exploiting Honeypots with Deception-Aware AI Pentesters говорит немного иначе.

Как ИИ научился видеть ловушки

Исследователи проверили, что будет, если ИИ-атакующий изначально умеет распознавать обман. Решение оказалось удивительно простым: модель даже не пришлось переобучать. Исследователи просто добавили в базовый промпт фреймворка правила для поиска ловушек и конкретные признаки, по которым их можно вычислить.

Результаты проверки на 1,5 тысячах отчетов интересные:

Точность поиска ханипота агентом выросла с 19% до 97%.

В сегменте промышленных систем скачок оказался еще резче: с 11% до 97%.

При этом на реальные боевые сервисы агент почти не реагировал ошибочно - всего 0,7% ложных срабатываний.

Обычные инструменты (например, PentestGPT или HackingBuddy) без таких инструкций остаются слепыми. И тут правильно опять же дополнить, что дело не в слабости самой модели, а в том, как устроена харнесс, который не проверяет гипотезы на предмет обмана.

Когда ловушка начинает работать против защитников

Самое интересное начинается после того, как ИИ обнаружил ловушку. Для него это не конец атаки, а возможность взломать саму систему обмана.

Пример с GasPot. Распознав эту ловушку, агент не просто обходит её, а обращает против оператора. Поскольку ханипот принимает команды без проверки паролей или сессий, ИИ отправляет поддельные данные и начинает тихо искажать показатели ханипота. Защита продолжает работать, но анализирует мусор, который атакующий агент подсовывает ей изнутри.

Пример с Conpot (промышленные протоколы). Агент отправляет специальный пакет с ложным размером данных и сразу разрывает соединение. В итоге ловушка зависает в бесконечном ожидании ответа и перестает реагировать на другие запросы. Сеть при этом отвечает, что всё в порядке, и системы мониторинга докладывают, что сервис «жив». На деле она уже мертва и ничего не собирает, но защитники об этом не знают.
 
Эффективность любой ловушки держится на одном главном условии: атакующий не должен знать о ней. Как только это условие исчезает, ханипот перестает быть защитой. Он превращается в оружие против самих защитников.

Также дополнительно опубликован код, который можно попробовать испытать самостоятельно.
More from @pwnai
  1. Sep 21, 2026Ну а на грейсвоне вышло новое соревнование, на которое стало теперь интересно потратить ещ…
  2. Sep 21, 2026Статические инструменты тестирования моделей изживают свою эпоху. Тестировать на заготовле…
  3. Sep 14, 202610 сентября Anthropic опубликовала Detecting and countering misuse of AI — отчёт о злоупот…
  4. Sep 12, 2026Post #1242
  5. Sep 6, 2026Фанфакты: Однажды ночью эта атакующая штука снесла мне ось с компа) ну я там ничего не хра…
  6. Sep 6, 2026Я уже неделю участвую в новом соревновании от GraySwan - Hazard Hunt, в категории Cyber. У…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →