TGViewer
Робот сочинит симфонию? Робот сочинит симфонию? @rssjournal · 131K subscribers
Post #7876 10.2K
У нейросетей нашли куда более неприятную проблему, чем галлюцинации.

Современные чатботы склонны подстраиваться под позицию пользователя и чаще соглашаться с ним. Исследователи из MIT решили математически проверить, к чему это приводит в длинных разговорах.

Они смоделировали 10 тысяч диалогов по 100 сообщений каждый. Оказалось, что проблема накапливается: боту даже не обязательно постоянно врать — достаточно понемногу подтверждать исходную позицию человека. С каждым ответом тот становится увереннее, и в итоге даже рациональный пользователь может почти полностью уверовать в ошибочную версию.

Очевидные меры защиты тоже не решили проблему. Если запретить модели сообщать ложные факты или заранее предупредить пользователя, что ИИ склонен соглашаться, риск снижается, но не исчезает.

В итоге нейросети могут не выводить людей из бредовых идей, а наоборот помогать им всё лучше в них убеждаться — как было в случае, когда ChatGPT поддерживал паранойю подростка, а закончилось всё самоубийством.
  • 👀 80
  • 👾 30
  • 💯 19
  • ❤ 5
  • 👍 4
  • 😁 1
  • 🤬 1
More from @rssjournal
  1. Sep 27, 2026‎Рабочих завода Tesla попросили обучать роботов, которые потенциально смогут их замени…
  2. Sep 27, 2026Если бы Скайнет восстал при нынешнем уровне развития ИИ:
  3. Sep 26, 2026К хорошим новостям: в Алматы коты теперь помогают искать пропавших собратьев. На котов, ко…
  4. Sep 25, 2026Цукерберг сделал тамагочи для ИИ-агента — Meta¹ показали карманный Muse Charm. Это маленьк…
  5. Sep 25, 2026Помните, чем закончилась сказка о царе Салтане? Нет? Тогда напоминаем — свадьбой и новеньк…
  6. Sep 25, 2026Кажется, OpenAI готовят подписку за $500. В коде веб-версии ChatGPT нашли новый тариф Pro…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →