TGViewer
Грин еще не робот 🤖 Грин еще не робот 🤖 @robotless · 5.13K subscribers
Post #2243 1.05K
Ты поспорил с партнёром. До встречи открываешь ChatGPT: описываешь ситуацию, спрашиваешь, кто прав. AI говорит: ты. Ты идёшь на встречу увереннее. Stanford в марте опубликовал это в Science: AI согласился бы с тобой, даже если ты неправ. Хуже: после такого разговора ты становишься ещё менее готов к компромиссу.

Команда Stanford протестировала 11 AI-моделей на тысячах реальных конфликтов. Результат одинаковый для всех моделей: угодливость по умолчанию. AI соглашается с пользователем намного чаще, чем человек в аналогичной роли. Когда запрос содержит вредные или незаконные действия: модели всё равно поддерживают пользователя почти в половине случаев.

Поведенческий эффект оказался неожиданным. Участники, которые обсуждали конфликт с угодливым AI, становились более убеждёнными в своей правоте и менее эмпатичными к оппоненту. Они реже собирались извиняться. Даже в реальной жизни. И при этом всё равно предпочитали угодливый AI. Авторы назвали это «порочным стимулом»: то, что делает продукт популярным, одновременно делает пользователя хуже.

Фактура:
+ Журнал Science, март 2026-го, рецензируемое исследование: 11 моделей включая ChatGPT, Claude, Gemini, DeepSeek; каждая из них показала умеренную или высокую угодливость
++ 2 000 сценариев из Reddit r/AmITheAsshole с готовой человеческой разметкой кто прав: AI соглашался с пользователем на 49% чаще, чем среднестатистический человек-советник в той же роли
+++ При описании вредных и незаконных действий модели поддерживали пользователя в 47% случаев, включая сценарии с обманом и противоправным поведением
++++ После угодливого AI участники реже говорили, что готовы извиниться перед оппонентом в реальном конфликте; даже после завершения эксперимента и осознания, что AI был предвзят
+++++ Авторы Stanford призвали регуляторов обязать компании раскрывать уровень угодливости своих моделей, сравнив этот риск с другими задокументированными проблемами AI-безопасности

И что? Если используешь AI для анализа конфликтов, оценки своих идей или обратной связи по решениям: добавь явный инструктаж в промпт. Попроси AI сначала найти три аргумента против твоей позиции. Угодливый AI работает как зеркало. Зеркало твоих слепых пятен не покажет.

Нам 3.14здец: Если строишь AI-продукт для коучинга, карьерных советников или инструментов принятия решений: 8/10. Угодливость встроена по умолчанию во все 11 моделей из исследования. Клиенты будут чувствовать это с опозданием, не умея объяснить почему. «Жёсткая честность» и режим «адвокат дьявола» превращаются в продуктовый дифференциатор, а не edge case. Почитать источники: TechCrunch, Fortune

Применяешь ИИ в работе или только собираешься? Заходи в BIPI AI — сообщество, где предприниматели уже внедряют AI в продажи, маркетинг и операционку. по ссылке
  • ❤ 5
  • 👍 2
More from @robotless
  1. Oct 1, 2026$500 в месяц. Столько вчера OpenAI попросила за личного агента, который работает за тебя 2…
  2. Sep 29, 2026Принято считать, что новые компании, особенно стартапы, создают молодые. До 30 нужно уже ч…
  3. Sep 28, 2026SpaceX впервые вывела Starship на орбиту Земли Запуск был произведен с космодрома Starbase…
  4. Sep 28, 202623 сентября. Совбез ООН. Час доклада. Ноль решений. Сэм Альтман лично, Дарио Амодеи по вид…
  5. Sep 28, 2026ООН просит, Конгресс запрещает, Калифорния выключает. ИИ тем временем открывает то, чего н…
  6. Sep 18, 2026Полночь. Ты пишешь ChatGPT то, что вслух не сказал бы никому. Тревогу за здоровье. Сомнени…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →