Prompt injection – это когда пользователь прячет в обычном тексте команды для встроенного ИИ, и тот выполняет их вместо инструкций разработчика, делая то, что не должен.
Классические фаерволы и проверки тут не спасают: вредоносная команда выглядит как обычный текст, а «уязвимость» живёт в самой логике модели, а не в коде.
— В материале разберем основные атаки на LLM-приложения, OWASP Top 10 для них и риски интеграций через MCP, инструменты AI red teaming вроде Garak и PyRIT и чек-лист из 10 пунктов для защиты.
↘️ Codeby
☑️ Записки Безопасника
⭐️ max.ru/infosec_globe
