Специализированные средства защиты AI-шлюзов (guardrails) стали стандартом для обеспечения безопасности приложений, взаимодействующих с моделями искусственного интеллекта. Эти механизмы проверяют каждый запрос к модели и ответ от неё, выявляя инъекции, утечки данных и нарушения политик. Шлюзы, такие как LiteLLM, Kong и TrueFoundry, теперь поддерживают интеграцию с внешними поставщиками таких защитных решений.
Рынок предлагает различные подходы к интеграции: от плагинов до прямых API-вызовов. Выбор зависит от того, какие данные шлюз может анализировать и какие действия выполнять. Особое внимание уделяется проверке потоковой передачи данных и защите от атак, использующих вызовы инструментов агентами.
ⓘ Что такое AI gateway guardrails
AI gateway guardrails — это механизмы безопасности и контроля политик, которые AI-шлюз применяет к каждому запросу к модели и каждому ответу. Они включают обнаружение инъекций и обход защиты, маскирование конфиденциальных данных, проверку контента и правил для агентов. Шлюз выступает точкой применения правил, а поставщик guardrail — движком обнаружения.
guardrails:
- guardrail_name: pillar-security
litellm_params:
guardrail: generic_guardrail_api
mode: [pre_call, post_call]
api_base: https://api.pillar.security/api/v1/integrations/litellm
api_key: os.environ/PILLAR_API_KEY
default_on: true
additional_provider_specific_params:
plr_mask: true # mask PII, card data and secrets before they reach the model
plr_evidence: true # return what was detected and where
plr_scanners: true # return per-guardrail verdicts
Источник: Pillar Security
@cbunit