Откуда ИИ-исследователи берут наборы данных, которые являются основой машинного обучения и построения моделей?
Опубликовано интересное исследование на основе анализа более 60 000 ИИ-исследований за 2015-2020 годы.
Результаты заставляют задуматься: насколько «универсальными» являются наборы данных, ведь более чем 50% из них происходят из одних и тех же 12 источников:
1.Стэнфордский университет (их наборы данных наиболее популярны)
2. Майкрософт
3. Принстонский университет
4. Общество Макса Планка
5. Гугл
6. Китайский университет Гонконга
7. AT&T
8. Технологический институт Тойота в Чикаго
9. Нью-Йоркский университет
10. Технологический институт Джорджии
11. Калифорнийский университет в Беркли
12. Фейсбук
При этом большинство наборов данных происходят из США (27 тысяч случаев использования) и Германии (2,6 тысяч случаев использования).
В то же время наборы данных из Бразилии использовались только в 11 случаях, из России — в 8 случаях, из Индонезии — в 2 случаях. Из всей Африки в выборки попал только Египет, и то только в 12 случаях.
Очевидно, что об универсальной точности и применимости моделей, обученных на таких данных, пока говорить не приходится.
Источник.
#искусственныйинтеллект
Post #316
100
- 👍 2