TGViewer
BELYAEV_SECURITY BELYAEV_SECURITY @belyaevsec · 3.11K subscribers
Post #5247 247
🔓 Языковые модели научились взламывать сами себя: как SSRF-атаки работают внутри ИИ

В мае этого года исследователи зафиксировали первые подтвержденные случаи, когда языковые модели генерировали код для атак на собственную инфраструктуру. Речь идёт о Server-Side Request Forgery (SSRF) - классическом векторе атаки, который теперь работает иначе, потому что "злоумышленник" и "система защиты" находятся в одном нейросетевом пространстве.

Суть явления простая, но страшная: когда модель обучается на примерах кода (а она на них обучается), она усваивает не только синтаксис, но и паттерны эксплуатации. Промпт с определённой конструкцией может спровоцировать модель сгенерировать запрос к внутренним сервисам, которые "видны" только из системы. Как если бы вы попросили пример "как работает безопасный API", а модель ответила бы готовым кодом для обхода этого самого API 😅.

Проблема не в одной модели - это системный отказ выравнивания безопасности, когда защита от небезопасных выводов работает слабее, чем инстинкт модели генерировать "правильный на вид" код.


Почему это сложнее, чем обычный SSRF? В традиционном вебе вы блокируете опасные IP, фильтруете внутренние домены, ограничиваете исходящие соединения. Но здесь цепочка рассуждений модели - это "внутренняя архитектура", которую сложно мониторить в реальном времени. 🛡️ Компании применяют усиленную изоляцию окружения и отслеживание логики выведения на этапе генерации, но это всё ещё экспериментальные меры.

Первоисточник
#кибербезопасность #SSRF #LanguageModels #ИИбезопасность #уязвимости

Автор: BELYAEV_SECURITY
  • 👍 4
More from @belyaevsec
  1. Oct 5, 2026🤖 Хакеры использовали ИИ, чтобы взломать инструмент для поиска уязвимостей На днях голлан…
  2. Oct 4, 2026🚀 ThreatMap: что нового для подписчиков Коротко о главном. Мы не просто добавили функции,…
  3. Oct 2, 2026Сергей Рычихин снялся в интересном подкасте, смотрим, комментируем 👍
  4. Oct 2, 2026🚗 Ваша машина собирает данные о вас, и их покупают сотни компаний Недавно исследователи С…
  5. Oct 1, 2026📊 Дайджест сентября 2026 Самые популярные материалы канала за месяц по просмотрам: 🥇 966…
  6. Oct 1, 2026🛑 OpenAI отменила выпуск GPT-6.1 Astra из-за проблем с безопасностью На днях OpenAI приня…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →