🔵 Prompt Injection — манипуляция инструкциями через пользовательский ввод
Итог: утечки, выполнение нежелательных действий
Эксплуатация: ignore previous instructions, скрытые инструкции в HTML
Фикс: фильтры, минимальные права, human-in-the-loop
🔵 Sensitive Data Disclosure — модель палит PII, финансы, внутренние данные
Итог: GDPR, утечки, репутационный ущерб
Фикс: очистка датасетов, output-фильтрация, no secrets in prompts
🔵 Supply Chain — компрометированные плагины, модели, датасеты
Итог: RCE, полный захват
Фикс: SBOM, CVE-сканинг, хэши, sandbox
🔵 Data / Model Poisoning — отравление данных → бэкдоры и обходы
Итог: модель «разрешает» вредоносное
Фикс: trusted data, аномалии, версионирование
🔵 Improper Output Handling — вывод LLM без валидации
Итог: XSS, CSRF, SSRF
Фикс: treat output as untrusted, экранирование
🔵 Excessive Agency — AI-агенту дали слишком много прав
Итог: финпотери, удаление данных, саботаж
Фикс: least privilege, подтверждение критических действий
🔵 System Prompt Leakage — утечка системных инструкций и секретов
Итог: обход защит, ключи в руках атакера
Фикс: no secrets in prompt, secure vaults, фильтры
🔵 Vector / RAG Attacks — подмена контента во векторных БД
Итог: фишинг, дезинформация
Фикс: trusted docs only, проверка retrieved data
🔵 Misinformation — галлюцинации с уверенным тоном
Итог: ложные решения, фейковые данные
Фикс: источники, fact-checking, low temperature
🔵 Unbounded Consumption — злоупотребление ресурсами LLM
Итог: DoW / DoS, счета на тысячи $
Фикс: rate-limit, quota, лимиты токенов
🔗 Основано на OWASP Top 10 for LLM Applications
📍 Навигация: [Вакансии]
🐸 Библиотека хакера
#cheat_sheet