Эксперты из Ассоциации больших данных разработали предварительный национальный стандарт для синтетических данных
Что это такое?
▪️Предварительный стандарт вводится для апробации новых технологий и действует не более трех лет. Затем он может перейти в статус обязательного к применению ГОСТа.
▪️Стандарт описывает процессы синтеза данных и требования к их качеству. До сих пор в России не было такого документа.
▪️Синтетические данные и прозрачный стандарт для них нужны, например, для обучения суверенных
моделей ИИ.
HFLabs тоже поучаствовал в этой большой работе. Вместе с АБД мы сделали практическое обоснование для использования синтетических данных в кейсе «Маркетинговая атрибуция».
Задача была такая: объединить данные двух независимых участников — рекламной площадки и банка — для оценки эффективности рекламной кампании. С помощью нашего решения «Маскировщик», мы проверили, возможно ли получить синтетический аналитический датасет, пригодный для расчета маркетинговых метрик, и при этом сохранить приватность.
Подробно исследование можно посмотреть и скачать здесь, а короткий вывод такой: синтетические данные, полученные методом обезличивания, достаточно точны для агрегированной аналитики (сводных отчетов и метрик). Они надежно защищают приватность, но при этом не подходят для анализа поведения отдельных пользователей.
HFLabs — о клиентских данных
Post #1008
672
Forwarded from HFLabs — о клиентских данных
- 👍 2
- 🔥 1