#короткие_ответы_на_серьезные_вопросы
Fine-Tuning vs RAG с точки зрения безопасности: «Что опаснее: утечка данных из дообученной (Fine-tuned) модели или утечка через RAG?»
«Это принципиально разные риски. Fine-tuned модель опаснее MEMORY (долгосрочной памятью), RAG опаснее CONTEXT (краткосрочной памятью).
В Fine-tuned модели знания вшиты в веса. Если злоумышленник проведет атаку извлечения (membership inference), он сможет вытащить куски обучающей выборки. Из весов нельзя "удалить" данные клиента, если регулятор (ЦБ или GDPR) потребует "право на забвение". Это юридическая и техническая катастрофа.
В RAG я могу просто удалить документ из векторной БД или настроить политику TTL (время жизни чанка). Но RAG опаснее в момент атаки, потому что непрямая инъекция может заставить модель выдать конфиденциальный документ в ответе прямо сейчас.
Для систем, работающих с персональными данными, я бы запретил полноценный Fine-Tune на сырых данных клиентов. Только RAG с жестким контролем доступа (ABAC) и обязательным логированием каждого извлеченного чанка».
Post #332
89