🔐Обучение ИИ на личных данных: какие риски и как сохранить приватность?
Один из самых распространенных вопросов при передаче данных в ChatGPT связан с конфиденциальностью. Действительно загонять в контекстное окно чата личные данные, номера карт и другую критическую информацию не нужно.
⚠️В чем опасность?
Многие сервисы могут использовать загруженные вами данные для дообучения моделей. Это значит, что ваши личные заметки и коммуникация с ассистентом могут попасть в обучающую выборку. Даже при условии полной анонимности.
✅ Важная функция ChatGPT
Мало кто знает, но OpenAI дают возможность своим пользователям регулировать сохранность своих данных. Для этого нужно перейти в Настройки → Элементы управления данными → выключить функцию Улучшить модель для всех. Все, такое простое действие обеспечивает запрет для OpenAI обучать свои модели на ваших данных и исключает их обработку (насколько это действительно так и какой процент информации попадает в алгоритмы дообучения – не известно).
Рекомендации для защиты данных
Даже при выключении этой функции лучше все-таки обезличивать данные. По возможности заменяйте имена, адреса, компании и другую чувствительную информацию. Если что-то действительно важно — лучше не загружать это в ИИ вообще.
Если прям заморочиться, то можно развернуть локальную модель у себя на компьютере (например, Llama или Mistral). Качество этих моделей не уступает облачным, но это подойдет, если вы работаете с крайне секретной информацией. Для остальных случаев намного проще пользоваться сервисами вроде ChatGPT с соблюдением правил безопасности.
А что по поводу Enterprise?
Для внедрения в корпоративную инфраструктуру и работы с важными данными компании правильным паттерном является формирование On-Premise решений — разворачивание аналогичных Open Source моделей на серверах компании.
🔝 Тут про планирование
Post #233
969

- 🔥 7
- 👍 4