LLM — это не «умный ответчик», а модель, которая предсказывает следующее слово. Сама по себе она не знает, что можно, а что нельзя. Безопасность — отдельный пласт, который добавляют поверх сырой модели. Если этот слой слабый или его сняли — модель становится уязвимой.
👨💻 Меня зовут Вадим Ахметов, я ML-инженер в команде платформы данных и аналитики. Мы делаем ИБ data-driven: превращаем сырые логи и телеметрию в детекты, метрики и модели, на которые опираются наши команды ИБ.
Хочу разобрать, как вообще получаются LLM, откуда берётся «небезопасность» и что реально делает модель защищённой.
🕵️ Читайте подробности в карточках выше
«Безопасность LLM — это не галочка, а слоёная защита. Alignment в весах можно ослабить или снять. Поэтому надёжность строится там, где модель применяется: фильтры, мониторинг, ограничение прав и постоянный red teaming».
Подписывайтесь:
💬 @Yandex4Security
📹 @YandexForSecurity





