TGViewer
Yandex for Security Yandex for Security @yandexforsecurity · 3.34K subscribers
Post #299 1.38K
🔍 Почему одна и та же нейросеть может быть и помощником, и оружием

LLM — это не «умный ответчик», а модель, которая предсказывает следующее слово. Сама по себе она не знает, что можно, а что нельзя. Безопасность — отдельный пласт, который добавляют поверх сырой модели. Если этот слой слабый или его сняли — модель становится уязвимой.

👨‍💻 Меня зовут Вадим Ахметов, я ML-инженер в команде платформы данных и аналитики. Мы делаем ИБ data-driven: превращаем сырые логи и телеметрию в детекты, метрики и модели, на которые опираются наши команды ИБ.

Хочу разобрать, как вообще получаются LLM, откуда берётся «небезопасность» и что реально делает модель защищённой.

🕵️ Читайте подробности в карточках выше

«Безопасность LLM — это не галочка, а слоёная защита. Alignment в весах можно ослабить или снять. Поэтому надёжность строится там, где модель применяется: фильтры, мониторинг, ограничение прав и постоянный red teaming».


Подписывайтесь:
💬 @Yandex4Security
📹 @YandexForSecurity
  • 🔥 7
  • ❤ 5
More from @yandexforsecurity
  1. Sep 17, 2026📺 OFFZONE 2026: записи наших докладов ♒️ «CTF в новой реальности: чему соревнования научи…
  2. Sep 14, 2026🔒 Гайд: как защитить VLM Меня зовут Полина Тикунова, я инженер по информационной безопасн…
  3. Sep 11, 2026🔒Как безопасно внедрять AI-агентов и не давать им ломать прод Недавно мы пообщались с Але…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →