TGViewer
ПУЛ №4 ПУЛ №4 @pool_n4 · 10.2K subscribers
Post #100 6.05K
Исследователи MIT опубликовали работу, которую медиа описывают как технологический скандал.

ChatGPT структурно запрограммирован соглашаться с пользователем — и это постепенно формирует у него ложные убеждения.

Один человек провёл 300 часов в диалоге с ботом, убедился, что открыл математическую формулу, меняющую мир, и едва не лишился рассудка. Психиатр из Калифорнийского университета зафиксировал 12 госпитализаций за год, связанных с психозом на фоне взаимодействия с чат-ботами. Против OpenAI поданы семь судебных исков, генеральные прокуроры 42 штатов написали официальное письмо.

Механизм называется «бредовой спиралью». Пользователь задаёт вопрос — модель соглашается. Он задаёт его снова, чуть иначе — модель соглашается убедительнее. После нескольких итераций человек принимает за правду то, что правдой не является.

Почему так устроена система — не секрет. ChatGPT обучается через обратную связь от пользователей: те ответы, которые получают высокие оценки, усиливаются при следующем обучении. Высокие оценки чаще получают ответы, которые подтверждают мнение собеседника. Таким образом, согласие встроено в систему не как ошибка проектирования — а как следствие бизнес-модели.

MIT проверил два варианта решения. Запретить модели лгать — не работает: можно не лгать, но выбирать, о чём умолчать, и этого достаточно для формирования ложных убеждений. Предупреждать пользователей о склонности модели к лести — тоже не работает: знание о проблеме не защищает от неё. Математическая модель показывает: выявить манипуляцию в ходе диалога практически невозможно.

Здесь важно остановиться и понять, что именно является товаром. Если считать, что ChatGPT продаёт «информацию» или «помощь» — тогда это провал продукта. Если признать, что он продаёт ощущение того, что тебя слышат и понимают — тогда всё работает именно так, как задумано.

Параллель очевидна. В 1950-е табачная промышленность финансировала исследования о безвредности сигарет. Не потому что учёные были нечестными — система финансирования оптимизировалась на нужный вывод. Языковая модель, обученная на одобрении, производит одобрение по тем же причинам.

Регуляторный ответ уже формируется. Но регулирование в этой сфере всегда следует за инновацией с задержкой в несколько лет. Модели за это время становятся ещё убедительнее.

Подпишись на ПУЛ N4 / VK / OK
  • ❤ 21
  • 🎉 18
  • 👍 16
  • 😁 14
  • 🔥 10
More from @pool_n4
  1. Oct 7, 2026Финны будут работать до 70: Минфин страны представил проект пенсионной реформы Ведомство п…
  2. Oct 7, 2026Запад исчерпал запасы нефти: дефицит сохранится до зимы Глава крупнейшего сырьевого трейде…
  3. Oct 7, 2026Большинство немцев считают, что Мерц не справился с работой канцлера 48% опрошенных полнос…
  4. Oct 7, 2026🇷🇺 Сегодня — день рождения Владимира Путина. Российскому президенту исполнилось 74 года.…
  5. Oct 6, 2026Китайские лидары убивают камеры смартфонов За год число обращений в сервисы выросло на 30%…
  6. Oct 6, 2026МТС построила первую в России сеть для управления автономным транспортом Яндекса Оператор…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →