Дообученная командой RWB модель BerryLM-XL заняла 3-е место в общем лидерборде MERA с интегральной оценкой 0,835. Для сравнения, результат Human Benchmark на тех же задачах составляет 0,852. В топ-5 также вошла BerryLM-v2, занявшая 5-е место с оценкой 0,810 ✅
«Мы дообучаем модели под конкретные сценарии маркетплейса — от поиска и сравнения товаров до инструментов для продавцов — и измеряем их влияние на продуктовые и бизнес-метрики. Результат MERA показывает, что мы предоставляем продавцам и покупателям доступ к решениям мирового уровня для автоматизации процессов и решения повседневных задач», — прокомментировал директор по данным RWB Павел Раваев
Модели семейства BerryLM уже используются в поиске и сравнении товаров, ИИ-ассистенте для покупателей, инструментах для продавцов и ряде внутренних сервисов компании.
Делаем подробный пост про BerryLM? Ставьте реакции 👀
Кстати, больше про ML в Wildberries & Russ — в @wb_delaet_ml. Подписывайтесь!
