TGViewer
False Positive False Positive @falseposi · 1.14K subscribers
Post #80 754
False Positive Чтобы ответить на вопрос "Насколько LLM помогают в кибербезе", нужно выяснить детали: - В каком домене кибербеза? - Опенсорсные LLM или закрытые? - Агенты или чистый LLM-ответ? - В теоретических знаниях или в действиях? - Как собрать линейку оценки? - Какие…
🎬Выкладываем запись Запись RG от Андрея Кузнецова, на которой разбирались существующие ИБ бенчмарки для LLM

P.S.: в комментариях выложим презентацию, в которой есть ссылки на все разобранные бенчмарки
  • 🔥 6
  • ❤ 5
  • 👍 4
  • ✍ 1
More from @falseposi
  1. Sep 30, 2026К нам в сореву залетела дрозофила🪰 И она уже расследует инциденты лучше чем мы А чего доб…
  2. Sep 25, 2026False Positive pinned a photo
  3. Sep 25, 2026Никто: Абсолютно никто: ИИ-агент, увидев PowerShell на сервере: 🚨🚨🚨 ВЗЛОМ 🚨 ВСЁ ПРОПАЛ…
  4. Sep 24, 2026Попробовать атакующих агентов кстати сейчас самим можно и в лабах и на CTF. А как повторит…
  5. Sep 24, 2026Выкладываем запись RG Глеба Кумичева про то как агенты хакнули HF #reading_group #openai #…
  6. Sep 18, 2026Мы начинаем🤗
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →