Секрет Полишинеля
Сотрудники читают реальные переписки пользователей с ИИ.
Схема утекла вместе с внутренними документами. Проверяющему показывают запрос и иногда даже весь диалог целиком. Он пересказывает своими словами, чего добивался человек, а потом оценивает несколько вариантов ответа модели по шкале от 1 до 7.
Ловят подхалимство, лишние эмодзи, менторский тон, «ИИ-канцелярит» и реплики, из которых выходит, будто у бота есть чувства и личный опыт.
Людей набирает рекрутинговая контора Crossing Hurdles. Имён аккаунтов проверяющие не видят, ПДн вычищает автоматический фильтр. Только OpenAI сами признают, что фильтр пропускает редкие идентификаторы и неоднозначные упоминания личного, особенно в коротких диалогах. Вдобавок к диалогу прилагается сводка памяти, о чём человек спрашивал раньше и чем интересуется.
Формально всё чисто, вы сами с этим соглашаетесь, так как соответствующий чекбокс включен по умолчанию 🥰
Anthropic, кстати, делает то же самое, а Google в своей политике прямо пишет, что часть сохранённых чатов смотрят люди.
НеКасперский
Post #5239
3.06K
- 😁 5
- ❤ 3
- 🗿 2
- 💩 1