Новость, которую мы заслужили)
OpenAI отстранила нескольких контрактных специалистов, которые должны были «очеловечивать» дообучение её моделей, после того как выяснилось: они сами использовали ИИ-инструменты при оценке ответов ChatGPT.
Тысячи ревьюеров читают анонимизированные диалоги пользователей ChatGPT, суммируют намерение пользователя и оценивают несколько ответов модели по шкале 1–7. Отдельная задача — снижать «подхалимство» и антропоморфизм модели, сдвигая оценки в сторону более сдержанного, профессионального тона.
Внутренние правила прямо запрещают использовать LLM, Grammarly, ИИ-перевод и детекторы вроде GPTZero при написании фидбека. Нарушителей выявляли по паттернам ИИ-текста (повторы, избыточная пунктуация, аномально быстрое выполнение) и отключали от проекта.
В чём риск для моделей
Если «человеческие» оценки и правки генерируются ИИ, дообучение идёт на синтетических данных. Это возвращает риск «модельного коллапса»: модели, обучаемые на ИИ-генерируемом тексте, могут необратимо деградировать.
Как-то нечестно получается. Если ИИ использует себя для своего улучшения, то это нормально, и мы можем его похвалить за этот прогресс, то человеку использовать ИИ для оценки и разметки ИИ — нельзя.
Post #433
169