💥В 13:00 у нас снова два потока.
✅В первом зале Андрей Гаврилов (EPAM) выступит с докладом “От Scikit-learn к PySpark MLlib. Адаптация моделей классификации к работе в распределённой среде”.
Всё чаще перед инженерами, работающими с Big Data, стоит задача масштабирования ML-моделей, что зачастую заключается в адаптации некоторого Data Science-решения к работе в распределённой среде. В докладе представлены подходы к решению задачи замены реализаций алгоритмов машинного обучения на распределённые аналоги. В частности, миграция со Scikit-learn на аналоги из библиотеки распределённого машинного обучения MLlib (PySpark). Рассматриваются модели для анализа семантики естественных языков TF-IDF и классические классификаторы (Наивный Байесовский и SVM) 👉 bit.ly/3c44Xma
Post #241
183