Исследование, проведенное группой учёных из США и других стран, показало, что ИИ можно полностью обучить на бесплатных и общедоступных материалах. Работа, основанная на 14 учреждениях, включая MIT и Университет Карнеги—Меллона, привела к созданию языковой модели с 7 млрд параметров, обученной на массиве данных объёмом 8 Тбайт. Этот массив включал 130 000 книг из Библиотеки Конгресса США.
Несмотря на подтверждение возможности создания ИИ без ресурсов, защищённых авторским правом, качество новой модели оказалось на уровне двухлетней давности.
В 2024 году OpenAI и другие эксперты утверждали, что без таких материалов современные модели ИИ не могли бы существовать. Теперь появились доказательства, опровергающие данное мнение. Учёные столкнулись с трудностями при подготовке данных из-за необходимости ручной аннотации и проверки лицензионных прав.
Исходная статья
@Unlim_AI
Post #1505
9.64K

- ❤ 10
- 👍 2
- 🦄 1