TGViewer
Swordfish Security Swordfish Security @secchamps · 606 subscribers
Post #553 333
🫢 Почему нейросеть может «проболтаться» о том, чему ее учили?

Компании обучают ML- и LLM-модели на внутренних данных: клиентских базах, переписках, коммерческих договорах. При этом мало кто задумывается о том, что обученная модель — это не «чёрный ящик», скрывающий свои источники, а полноценный актив, из которого при определенных условиях можно восстановить фрагменты исходных данных.

⚠️ На этом строятся атаки Membership Inference и Training Data Extraction. С их помощью можно попытаться выяснить, были ли конкретные данные в обучающей выборке, или извлечь из модели фрагменты исходных данных. Отдельный сценарий — Model Extraction, когда по запросам и ответам модели создают её копию.

В новой статье Анна Данилова, руководитель направления статического анализа безопасности приложений Swordfish Security, и Денис Данилов, руководитель группы обеспечения безопасности приложений Swordfish Security, разбирают:

🎱как модели могут запоминать обучающие данные;

🎱какие могут быть последствия перечисленных атак;

🎱почему API и чат-интерфейс уже могут быть достаточной точкой входа для атаки;

🎱и какие меры помогают снизить риски.

Читайте статью в BIS Journal на 62 странице. 🖥

🐟 Рассылка | Max | Habr

#SFS_экспертиза #AISecurity
  • 🔥 6
  • 👍 5
  • ❤ 4
More from @secchamps
  1. Sep 30, 2026🤒 Хакеры создали для PS5 новый метод взлома На связи Влад Павловский, руководитель группы…
  2. Sep 29, 2026⚡️ИИ-агента для программирования можно взломать через обычный сайт В OpenCode, популярном…
  3. Sep 25, 2026📱Статический анализ Android-приложений: с чего начать Современные мобильные приложения хр…
  4. Sep 15, 2026🎤 Swordfish Security на VolgaCTF 2026 С 16 по 18 сентября в Самаре пройдет финал открытых…
  5. Sep 11, 2026🔒Как построить эффективную защиту API на реальных проектах Согласно исследованиям, вызовы…
  6. Sep 9, 2026🇷🇺 Пишет ИИ, а отвечает разработчик: зачем внедрять AI Security уже сейчас По данным АФТ…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →