TGViewer
Beyond the LLM 🌓 Beyond the LLM 🌓 @beyondthellm · 45 subscribers
Post #92 593
👀 Недавно прочитал статью Валерия Бабушкина (https://www.linkedin.com/in/venheads/), про неоднозначность precision в продакшн‑сценариях вроде фрода или спама. Метрика выглядит хорошо на бумаге, но при изменении доли позитивного класса может сильно упасть, хотя TPR/FPR остаются стабильными.

💻 У меня был кейс с внедрением NLP-модели для проверки заявок в кредитном скоринге: на тесте precision была почти 0.9, но при росте объёма заявок и изменении их качества фактический «хороший» результат по бизнес-KPI упал в два раза. Переключились на фиксированную специфичность и максимизацию recall, и модель стала стабильно полезной в продакшне.

🚩Вывод: для систем с редкими событиями лучше смотреть на TPR/FPR или recall при фиксированной специфичности, а не на precision как на главный ориентир.

Статья: https://www.linkedin.com/pulse/why-precision-dangerous-metric-valerii-babushkin/?trackingId=4ANfb3R7Tc8nEiTB2rHz5A%3D%3D
Linkedin Why precision is a dangerous metric I had a recent conversation with a friend of mine regarding the evaluation of fraud models. Of course, no metric is ideal, and it always depends on what is the final goal.
  • 🔥 25
  • 👍 24
  • 💯 24
  • 👌 18
  • 🐳 8
  • ❤‍🔥 8
  • 😱 7
  • 🤮 2
  • 👻 1
More from @beyondthellm
  1. Sep 16, 2026Post #256
  2. Sep 14, 2026Post #254
  3. Sep 13, 2026Post #253
  4. Sep 11, 2026#собесы Разбор кейса с System Design интервью 🎯Задача: Есть система трекинга показателей…
  5. Sep 10, 2026🫪Сегодня с @oudser выступаем в качестве спикеров у @M0rtyMerr🐺
  6. Sep 10, 2026Релокация в сентябре 2026 / Где лучше пожить после выборов 10 сентября в 19:15 на стриме п…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →