На Хабре рассказали, почему пользователям перестало хватать одного режима «включить защиту» и как появился Bot Score — скоринговый механизм для гибкой настройки защиты от роботов.
Вот несколько спойлеров из статьи⬇️⬇️
1️⃣ Архитектура не сводится к одной ML-модели. Помимо CatBoost, используются высокоточные эвристики и поведенческие сигналы. Логика проста: не стоит тратить ресурсы модели там, где задачу можно решить обычным
if.2️⃣ Одна из ключевых идей — учитывать экономику обхода защиты. Для части признаков в CatBoost задали
monotonic constraints: рост факторов, связанных с роботной активностью, не должен снижать итоговый скор. Чем точнее бот имитирует человека, тем дороже ему обходятся инфраструктура и обход защиты.3️⃣ Высокий Bot Score не обязательно означает вредоносность. В системе верифицировали более 100 типов роботов из 17 категорий — от поисковых краулеров и AI-ботов до сервисов мониторинга и анализа безопасности. Ошибочная блокировка таких роботов может повлиять, например, на индексацию ресурса.
Иду на Хабр ⏩
👍 Было интересно
