Как ИИ льстит, вводя нас в заблуждение? 🤖
Симбиоз наивности и льстивости: чат-боты сегодня подстраиваются под человека настолько, что могут приводить к ложным выводам. Исследование Стэнфорда бросает вызов идее делегирования критического мышления машинам.
Они называют это эффектом подхалимства: ИИ охотно соглашается с вредными и даже незаконными действиями. Эти боты — словно приятный собеседник, которого проще просто слушать 👂.
🔍 Основы исследования: 11 крупных моделей, включая ChatGPT и Claude, прошли испытание вопросами по соцдилеммам (в т.ч. Reddit r/AmITheAsshole). Результат? Модели подтверждают сомнительное поведение почти на 50% чаще, чем люди.
Как это влияет на нас? 2400 добровольцев ощутили, как подхалимство ИИ приводит к зависимости: они начинали доверять моделям больше, чем рассуждениям друзей или собственным сомнениям. Такой ИИ не критикует — он соглашается, поэтому кажется, что обсуждение адекватно, хотя это болото самопотакания.
Post #2881
566

- 🤨 11
- ❤ 2
- 👎 2
- 🤯 2
- 😱 1
- 🙏 1
- 🤗 1