Издание 404 Media раскрыло в своём новом расследовании подробности закрытого проекта 🤖Project Lily, в рамках которого компания OpenAI привлекает 🎩 сотни сторонних людей для чтения реальных диалогов пользователей ChatGPT.
Журналисты 404 Media выяснили, что подрядчики просматривают полные ветки переписок пользователей с ChatGPT. Логины для них скрыты, а сообщения проходят через автоматический фильтр Privacy Filter, но компания признаёт, что система нередко пропускает приватные сведения. Оценщики видят блок сохранённых воспоминаний пользователя (user memories summary), где могут содержаться детали о его личной жизни и регионе проживания.
🎩Оценщики анализируют запросы и оценивают сгенерированные варианты ответов по шкале 👁 от 1 (неприемлемо) до 7 (отлично). Основная цель заключается в том, чтобы отучить ИИ-модели от антропоморфизма, чрезмерной угодливости, неуместных эмодзи и шаблонного стиля. Внутренние инструкции требуют отучать модель от угодливого поведения — как отмечают журналисты, ранее эта проблема GPT-4o уже фигурировала в судебных исках после трагических случаев с пользователями.
Рецензентам предписано штрафовать модель за неуместные эмодзи и шаблонный машинный язык. Например, использовать символ 🌲дерева при обсуждении Дня древонасаждения разрешено, но эмодзи ☠️черепа при разговоре о смерти или самолёта в контексте авиакатастрофы строго запрещены.
Массовая расстановка зелёных галочек ✅ в списках признана маркером неестественного текста из соцсетей, поэтому за неё оценку тоже снижают.
Интересно...
Забавно то, что 🤓людям-оценщикам попадаются некоторые сообщения, где пользователи 🙏 просят чат-бот сохранить разговор втайне от всех, искренне полагая, что ведут "защищённый диалог" наедине с ИИ.
Таким подрядчикам-операторам платят более 💸$50 в час. Поиском кандидатов занимается рекрутинговое агентство Crossing Hurdles, а фактическим нанимателем выступает компания Mercor, с которой Meta* прекратила сотрудничество в апреле из-за масштабной утечки данных.
Передача сообщений для обучения включена по умолчанию в бесплатных аккаунтах, а также на платных тарифах Plus и Pro. Отключение пункта «Улучшать модель для всех» защищает только будущие чаты и не действует задним числом. Для личных аккаунтов Free, Plus и Pro пункт "улучшение моделей" включён по умолчанию.
👆Привлечение людей к анализу чатов не уникально для OpenAI. В материале указано, что Anthropic и Google также используют ручную проверку диалогов для совершенствования Claude и Gemini, если у пользователя включены соответствующие настройки согласия. Получив запрос от журналистов, OpenAI оперативно переписала справочный раздел об отказе от обучения, но так и не внесла туда прямое предупреждение о чтении чатов живыми людьми. Представители компании лишь постфактум сослались на раздел сайта, где говорится о проверке контента людьми для «улучшения работы модели».
Ни капли удивления...
*Деятельность компании Meta (владеет Facebook, Instagram, WhatsApp) запрещена в РФ и признана 🏴☠️экстремистской.
✋ @Russian_OSINT
