TGViewer
MLinside - школа ML MLinside - школа ML @ml_inside · 4.07K subscribers
Post #317 2.02K
Разбор задач с собеседований

Ответы на вопросы:
1️⃣ Что вы чаще всего использовали для проверки качества моделей из Scikit-Learn?
Чаще всего в Scikit-Learn для оценки качества моделей используют:
- cross_val_score — кросс-валидация с метриками (accuracy, F1, R² и др.)
- train_test_split — разделение на тренировочную и тестовую выборки для простой оценки
- Метрики из модуля metrics (accuracy_score, precision, recall, roc_auc, mean_squared_error и др.) для измерения качества на тесте


2️⃣ Какие бывают усреднения метрик?
Основные виды усреднения метрик (особенно для многоклассовых задач):
- micro — считает метрику по всем объектам сразу (агрегирует TP, FP, FN), подходит при несбалансированных классах.
- macro — усредняет метрики по классам одинаково, без учёта их размера, подчеркивает производительность на редких классах.
- weighted — усредняет по классам с весами, пропорциональными количеству объектов в каждом классе, баланс между micro и macro.


3️⃣ Bag of words – плюсы и минусы использования?
Bag of Words (BoW):
- Плюсы: простая, быстрая, интерпретируемая. Хорошо работает на коротких текстах.
- Минусы: игнорирует важность слов и контекст. Зависит от частоты, может переоценивать часто встречающиеся, но малоинформативные слова. Высокая размерность и разреженность

#собеседования_Mlinside
  • ❤ 12
  • 👍 2
  • 👎 2
  • 🔥 2
More from @ml_inside
  1. Sep 25, 2026Post #595
  2. Sep 25, 2026Post #594
  3. Sep 23, 2026Сегодня стартует 5-й поток курса «База ML» 🚀 «База ML» – курс для новичков в ML и специал…
  4. Sep 22, 2026AI Engineering Skills Map: как работать с coding agents Где-то месяц назад мы разбирали AI…
  5. Sep 21, 2026Сегодня в 19:00 МСК встречаемся на закрытом вебинаре с Виктором Кантором «Из аналитики и р…
  6. Sep 20, 2026Post #584
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →