🧨 Новый способ защитить сайт от AI-скраперов
Исследователи представили ShieldFont, необычный шрифт, который выглядит для человека нормально, но подсовывает AI-скраперам другую информацию.
⚙️ Принцип работы
Визуально пользователь читает обычный текст.
Но многие AI-краулеры получают контент не так, как человек. Они анализируют HTML и символы страницы, а не финальное изображение текста.
ShieldFont использует механизм OpenType Glyph Substitution, из-за которого один и тот же текст одновременно существует в двух версиях:
🔹 человек видит оригинальную статью;
🔹 AI получает слова с изменённым смыслом.
Например, отдельные существительные незаметно заменяются другими. Предложение остаётся грамматически правильным, но уже передаёт совсем другой факт.
🧠 Отравление датасетов вместо блокировки
Задача сделать украденные данные бесполезными. В тестах авторов 55,8% защищённых фрагментов после обработки больше не сохраняли исходный смысл. При этом текст успешно проходил через типичные пайплайны сбора данных и мог попасть в обучающий датасет уже в искажённом виде.
Получается необычная стратегия защиты, вместо запрета на копирование злоумышленнику разрешают забрать данные. Однако эти данные уже содержат скрытую "дезинформацию" для модели.
🛡️ Идеальной защиты нет
Авторы честно признают, что ShieldFont нельзя назвать невзламываемым. Если кто-то целенаправленно исследует конкретный сайт, он сможет восстановить соответствие символов.
Однако для массового AI-скрапинга стоимость атаки резко возрастает. Теперь бот не может заранее понять, использует ли сайт подобную защиту и насколько можно доверять собранному контенту.
🔗 Исследование и проект: https://shieldfont.com
🔗 GitHub: https://github.com/isaqueseneda/shieldfont
Stay secure and read SecureTechTalks 📚
#кибербезопасность #AI #LLM #ShieldFont #AIScraping #DataPoisoning #AgenticAI #WebSecurity #CyberSecurity #SecureTechTalks
Post #828
200

- 👍 1