🧱 Локальная модель не решает проблему персональных данных
Самый частый ответ на вопрос «а как вы закрываете ПДн в LLM»: «у нас всё локально, данные не уходят».
Проблема в том, что «не уходят наружу» ≠ «защищены». Как только сырой текст попал в контур, персональные данные оказываются в:
— логах приложения и трейсах запросов
— кэшах и очередях
— RAG-индексе, откуда их достанет любой, у кого есть доступ к поиску
— обучающих выборках, если вы дообучаете модель на своей переписке
— выгрузках и бэкапах
Поэтому обезличивание стоит ставить не «на границу с интернетом», а до инференса. Тогда ниже по стеку – только токены, и вопрос «кто имел доступ к ФИО клиента» решается в одном месте.
Плюс идея для бизнеса – очистка данных перед ЛЛМ (такого добра уже много, но тем не менее...)
Post #3
76
- 🔥 1