🎙Обезличивание данных в базах: в чем сложность и как организовать процесс
Деперсонализация кажется простой задачей, пока не сталкиваешься с реальностью. На практике это полноценный инженерный вызов, сочетающий профилирование, проверку бизнес-логики, оптимизацию и работу с нетривиальными особенностями инфраструктуры.
В статье Петр Мельченко, лид команды разработки в «Перфоманс Лаб», и Василий Жидков, продакт-менеджер инструмента «Датасан» делятся уникальным опытом: разбирают подводные камни, через которые проходят все команды, пытаясь организовать обезличивание в больших системах. И, конечно, дают решения, чтобы пройти этот путь быстро и без проблем.
➡️ Как правильно выделить и обработать персональные данные? Например, как автоматически выделить именно ИНН, а не произвольный набор цифр?
➡️ Технические сложности профилирования: категоризация данных, сборка движка.
➡️ Тонкости деперсонализации: работа с проблемными сущностями, правильные настройки баз данных и таблиц.
➡️ Оптимизация алгоритмов обезличивания: как распараллелить процессы, пересобрать логику и выстроить работу планировщиков.
Post #56
715

- ❤ 4
- 🔥 4
- 👍 1
- 😁 1