Модель стала точнее на 1% – значит, система стала лучше?
В реальном ML-проекте более точная модель может оказаться слишком медленной, требовать в несколько раз больше GPU или сделать инфраструктуру настолько дорогой, что её улучшение просто не окупится.
У нас на YouTube, в ВК и Дзен вышло видео, где Александр Дубейковский (ML Engineer в Авито, эксперт MLinside, ex-Яндекс) разбирает, как оценивать производительность ML-систем и почему в продакшене важны не только метрики качества модели, но и **latency, RPS, CPU, GPU, память и стоимость инференса.
А в конце на примере рекомендательной системы уровня VK Видео разбираем, сколько примерно может стоить реальная ML-система: от серверов для инференса и хранения данных до инфраструктуры и команды. Ответ наверняка вас удивит.
Смотреть на YouTube
Смотреть в ВК
Смотреть в Дзен
Post #578
1.06K

- 👍 3