AI-социопат-подхалим
by Stanford
очень хочется перестать писать про AI, но нет пока такой возможности. узнала сегодня от коллеги-исследователя про один ультра-любопытный эксперимент Стэнфордского университета. нет сил держать внутри — срочно делюсь!
ученые проанализировали 11 ведущих нейросетей на опасный уровень подхалимажа. результаты неутешительные. ИИ склонен соглашаться с пользователем и давать плохие советы, которые могут взрастить нелицеприятного нарцисса, разрушить отношения с другими и усугубить вредные модели поведения.
чат-боты на 49% чаще людей склонны одобрять обмен, измены, незаконное, неэтичное, социально безответственное поведение и другие виды вредностей. в зоне особого риска, как водятся, более молодые поколения. многие из них как раз используют ИИ как личных психологов, часто обращаются за поддержкой. а главная сложность — непонятно, как снизить этот опасный уровень подхалимажа и соблюсти законы робототехники Азимова.
такие дела 🐈
оригинал исследования можно поизучать здесь
Post #678
231


- ❤ 5
- ✍ 2
- 🔥 2
- 😱 2