TGViewer
IT/AI Owl (Сергей Спевак) IT/AI Owl (Сергей Спевак) @itaiowl · 1.83K subscribers
Post #143 137
Минимальная защита данных, которая должна быть у каждого финансового специалиста

Perplexity открыла модель для поиска и маскирования персональных данных в переписках и текстах — pplx-pii-masking.

На первый взгляд — очередная небольшая модель на 600 млн параметров. Но на самом деле это один из тех инструментов, которые должны стать базовой гигиеной работы с данными.

Финансовые специалисты, бухгалтеры, юристы, HR, менеджеры, аналитики — ежедневно работают с именами, телефонами, адресами, договорами, номерами счетов, ссылками на внутренние системы, паролями и ключами доступа.

А потом эти данные очень легко оказываются в промпте к внешней LLM: «сделай выжимку из переписки», «проанализируй договор», «помоги составить ответ клиенту».

И вот здесь важный момент: данные уже ушли за пределы вашего контура. Даже если намерения были самые хорошие.

pplx-pii-masking умеет находить и заменять на маски:
• ФИО и другие персональные данные;
• номера счетов;
• адреса, email и телефоны;
• приватные ссылки;
• даты;
• секреты: пароли, токены, ключи доступа.

То есть перед отправкой текста в ChatGPT, Claude или корпоративного AI-агента можно превратить:

«Клиент Иван Петров, счёт 40817..., напишите ему на ivan@company.ru»

в текст, где реальные значения заменены на [PRIVATE_PERSON], [ACCOUNT_NUMBER], [PRIVATE_EMAIL].

Под капотом — не генеративная LLM, а двунаправленный энкодер Qwen3 с отдельными головами для разметки PII и оценки чувствительности всего документа. Модель работает с контекстом до 4096 токенов и распространяется по лицензии MIT — её можно развернуть внутри своей инфраструктуры и встроить в собственный пайплайн. Технические детали — в карточке модели.

Но давайте без магии.

Это не готовый DLP, не юридическая индульгенция и не гарантия, что модель никогда ничего не пропустит. Для критичных процессов нужны тестирование на ваших данных, правила обработки, контроль доступа и журналирование.

Но как первый защитный слой перед любым внешним AI — это уже не nice to have.

Это минимальная защита, которая должна стоять на каждом компьютере, где работают с деньгами, персональными или конфиденциальными данными.

Потому что обезличить данные до отправки — всегда дешевле, чем потом объяснять, как они утекли.
  • 🔥 5
  • 👍 2
  • 💯 2
More from @itaiowl
  1. Sep 27, 2026Зачем модели делать больно? Исследователи дали языковой модели две кнопки. Одна ничего не…
  2. Sep 26, 2026Узкопрофильная и при этом очень разносторонняя конференция.
  3. Sep 25, 2026Сегодня рассказываю коллегам юристам как правильно внедрять ИИ в их сферу. Буду рад пообща…
  4. Sep 23, 2026OPUS 5.5: ДЕШЕВЛЕ, БЫСТРЕЕ, УМНЕЕ. НО ЕСТЬ НЮАНС Вчера Anthropic выпустила Claude Opus 5.5…
  5. Sep 21, 2026ИИ появился четыре года назад? Иногда даже в профильных сообществах люди читают, что я зан…
  6. Sep 20, 2026Друзья, приветствую! 22 сентября я выступаю по приглашению организаторов на БИЗНЕС ФОРСФОР…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →