Издание 404 Media опубликовало расследование об увольнениях подрядчиков, которые обучают ИИ-модели компании OpenAI. Поводом для расторжения контрактов стало использование генеративного ИИ самими исполнителями при проверке и разметке данных.
Главная задача подобных специалистов-операторов заключалась во внесении живого человеческого опыта в оценку ответов ChatGPT, чтобы защитить ИИ-модели от эффекта так называемого коллапса. Однако многие исполнители поручали свою «живую» работу сторонним языковым моделям, пытаясь ускорить монотонный процесс. В итоге разработчик рискует получить синтетическую оценку, ошибочно считая её человеческой.
Когда подрядчик вместо самостоятельного анализа доверяет проверку генеративным сервисам, возникает замкнутый цикл, где один🤖ИИ обучается на сгенерированных ответах другого 🤖ИИ, из-за чего качество работы модели со временем сильно ухудшается.
Точное общее число уволенных подрядчиков в материале 404 Media не приводится. OpenAI отказалась от комментариев. По словам одного из исполнителей, использование ИИ стало главным поводом для мгновенного расторжения контракта.
📊По внутренним документам, всего в проектах оценки данных может быть задействовано более 10 000 подрядчиков.
Ранее издание сообщало об инициативе Project Lily, где🤓 сотни специалистов читали реальные диалоги пользователей с ChatGPT, включая персональные данные, чтобы устранить антропоморфизм чат-бота и снизить чрезмерную угодливость в его ответах.
✋ @Russian_OSINT
