TGViewer
Нейро Нейро @neuro_code · 55.9K subscribers
Post #7555 4.32K
У нейросетей нашли куда более неприятную проблему, чем галлюцинации.

Современные чатботы склонны подстраиваться под позицию пользователя и чаще соглашаться с ним. Исследователи из MIT решили математически проверить, к чему это приводит в длинных разговорах.

Они смоделировали 10 тысяч диалогов по 100 сообщений каждый. Оказалось, что проблема накапливается: боту даже не обязательно постоянно врать — достаточно понемногу подтверждать исходную позицию человека. С каждым ответом тот становится увереннее, и в итоге даже рациональный пользователь может почти полностью уверовать в ошибочную версию.

Очевидные меры защиты тоже не решили проблему. Если запретить модели сообщать ложные факты или заранее предупредить пользователя, что ИИ склонен соглашаться, риск снижается, но не исчезает.

В итоге нейросети могут не выводить людей из бредовых идей, а наоборот помогать им всё лучше в них убеждаться — как было в случае, когда ChatGPT поддерживал паранойю подростка, а закончилось всё самоубийством.

Нейро
  • 👍 7
  • 🔥 6
  • 🤨 3
  • ❤ 2
More from @neuro_code
  1. Oct 8, 2026Вайб-кодинг можно ощутить буквально — разрабы наконец-то скрестили Claude Code со смарт-ви…
  2. Oct 7, 2026Призовой фонд — более 10 млн рублей, и только практические задачи — главное, что нужно зна…
  3. Oct 7, 2026Неделю назад прошла, пожалуй, самая массовая волна блокировок российских аккаунтов Claude:…
  4. Oct 7, 2026Маркетплейсы тайно оценивают даже фигуру клиентов — юзеры нашли в настройках Amazon выводы…
  5. Oct 7, 2026Мэр столицы Албании управляет городом из тюрьмы с помощью ИИ-аватара — он выпустил видеооб…
  6. Oct 7, 2026Как перевести ИИ из статьи расходов в статью прибыли? газета Selectel. Регистрируйтесь на…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →