TGViewer
Big Ledovsky | AI изнутри Big Ledovsky | AI изнутри @big_ledovsky · 2.06K subscribers
Post #305 1.37K

Forwarded from Доска AI-объявлений (Alexander Ledovsky)

Почему мы не используем ассессоров для выкатки моделей в поиске

Осенью я участвовал в конференции IML в качестве эксперта. Моя роль была в том, чтобы после доклада Коли Смирнова про поиск «Лавки» поучаствовать с ним в дискуссии. И мы как раз затронули эту тему: ребята используют ассессоров, а я объяснял, почему у нас это не работает.

Идея ассессоров следующая:

👉 Допустим, вы переобучили поисковой ранкер и получили хорошие ML-метрики, условный NDCG.

👉 Затем вы посылаете на ассессоров заранее подготовленный пул запросов, отранжированных новой и старой моделью, и получаете оценку качества от людей.

Проблемы начинаются тогда, когда вы ранжируете не по релевантности. Мы учитываем сразу много факторов в выдаче: релевантность, кликабельность объявления, монетизацию, репутационные скоры. А ещё нужно не забыть, что частные продавцы на Авито должны получать свой трафик, чтобы их не выдавили профессионалы.

Поэтому никакой ассессор не сможет оценить, насколько хорошо мы собрали выдачу.

Мы используем специальную оффлайн-приёмку, где считаем метрики по заранее сформированным пулам запросов, но по скорам моделей и количеству объявлений разных типов. Например, если сильно просадили частников — плохо.

Думаю, что в какой-то момент от нас выйдет подробный доклад по этому поводу. Там много интересного: и как формировать пулы, и как подбирать хорошие оффлайн-метрики, и как сделать инструмент быстрым в использовании.

P.S. На самом деле ассессоров мы используем. Но только для сбора специального датасета для обучения модели релевантности. Но это не то же самое, что оценка поисковой выдачи в целом.
  • 👍 14
More from @big_ledovsky
  1. Oct 5, 2026Разбирался в текущих железках NVIDIA Моя текущая роль предполагает отвечать на вопросы в д…
  2. Oct 1, 2026Блокировка ChatGPT Никогда такого не было и вот опять 🙂 Теперь уже мой личный аккаунт, ко…
  3. Sep 28, 2026Про openspec Решил попробовать openspec для adhoc задач, фреймворк для spec driven develop…
  4. Sep 24, 2026Годный курс по AI для менеджеров Меня довольно часто спрашивают, что я могу порекомендоват…
  5. Sep 22, 2026Про Jev 1. Наконец-то! Появились LLM, которые отвечают не текстом, а сразу тем что нужно.…
  6. Sep 21, 2026Что станет с поиском и рекомендациями в эпоху LLM 🦜 По следам дискуссии на Practical ML Р…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →