Очень красивая история. Коллектив товарищей из MIT и Berkley доказал, что при обучении машинлёрнинговой модели её можно будет собрать с "бэкдором". Например, так, что скоринговая модель банка всегда будет одобрять кредит определённому заёмщику. Или, как в сериале Altered Carbon - камеры не смогут распознать конкретного человека. Что самое важное в их статье - это математичеки строгое доказательство того, что подобный финт ушами принципиально невозможно выявить и доказать. Даже если банк - заказчик кредитного скоринга запросит исходники модели и training dataset, модель с "бэкдором" неотличима от нормальной.
Последний апдейт от ноября 24 года, и там правда прикольно
https://arxiv.org/abs/2204.06974
Post #57
469