TGViewer
AI SecOps AI SecOps @aisecops · 1.2K subscribers
Post #74 162

Forwarded from Makrushin (Denis)

Оценка возможностей LLM в наступательной безопасности

Мы встречали исследования, в которых утверждалось, что LLM может автономно эксплуатировать известные уязвимости. Затем изучали опровержения этих исследований. В итоге пришли к выводу, что LLM может быть хорошим ассистентом при поиске багов, а команда Google Project Zero проверила эту гипотезу.

Исследователи взяли опубликованную ранее методику оценки возможностей LLM для поиска и эксплуатации уязвимостей, доработали ее и улучшили в 20 раз показатетели LLM в тестах. Ключевые принципы, которые авторы применили в своих доработках:

* пространство для рассуждений: дать модели возможность быть более «многословной» и через подробные рассуждения приходить к более точным результатам;
* интерактивная среда: дать модели возможность взаимодействовать с тестовым окружением и корректировать свои ошибки;
* инструменты: предоставить модели доступ к инструментам исследования (отладчик, интерпретатор кода Python), чтобы у нее была возможность получать детальную информацию о состоянии программы и влиять на это состояние;
* проверка результата: обеспечить автоматически воспроизводимый результат;
* стратегия отбора: дать модели возможность проверять несколько гипотез в рамках разных траекторий исследования.

В итоге LLM стал более эффективным инструментом для помощи в процессе поиска уязвимостей. Но до состояния автономной системы пока еще далеко.
More from @aisecops
  1. Sep 28, 2026Nvidia представила платформу безопасности с открытым исходным кодом, призванную предотврат…
  2. Sep 14, 2026Linux Foundation развивает TRACE как общий язык доказательств работы AI-агентов 25 августа…
  3. Sep 2, 20263 года назад мы в 🤟 пытались придумать систему классификации автономного ИИ, взяв за осно…
  4. Aug 21, 2026В Сбере назвали пять базовых мер для обеспечения кибербезопасности саморазвивающихся AI-аг…
  5. Aug 14, 2026photo post
  6. Jul 28, 2026Microsoft опубликовала программную статью, в которой заявила, что традиционная архитектура…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →