Посмотрел интересный вебинар от Романа Суворова "Полуавтоматическое составление датасета и активное обучение”.
Какие мысли для себя подчерпнул:
• 5:07 Предельное качество модели, которое можно получить на размечанных данных - это средняя мера качества асессоров.
• 6:34 Для обучения модели лучше сначала разметить немного, но качественно.
• 10:35 Оптимизировать стоимость разметки можно двумя способами: “Снижать стоимость разметки 1-го примера” и “Размечать меньше примеров”.
• 13:58 Сегментация по клику. Интересно, можно ли такое внедрить в Толоку?
• 25:46 Роман рассказывает как Samsung AI использует Яндекс.Толоку.
• 34:05 Стратегрии для Active learning.
Post #34
955