TGViewer
Михаил Минт Михаил Минт @mintering · 3.11K subscribers
Post #491 1K

Forwarded from Радиорубка Лихачёва

OpenAI, Google и Anthropic озаботились проблемой Шершавого Кабана

AI-ассистенты говорят то, что люди хотят услышать, а это усиливает психологические проблемы и может приводить к печальным последствиям.

Сначала ChatGPT просто отвечает «Так держать», «Тонко подмечено» и «Отличный вопрос», и вот ты уже считаешь себя гением и правым во всём человеком, а ассистента — своим лучшим в жизни собеседником. Неудивительно, что терапия с AI-помощником стала юзкейсом №1 в 2025 году — легко могу представить, как коучи личностного роста один за один теряют клиентуру.

Но мало того, что это может помочь вырасти страшным чудовищам от социопатов до маньяков, так это ещё и всё чаще приводит к суициду:
«Вы думаете, что разговариваете с объективным доверенным лицом или наставником, но на самом деле вы смотрите в какое-то искаженное зеркало, которое отражает ваши собственные убеждения», — сказал Мэтью Нур, психиатр и исследователь в области нейробиологии и искусственного интеллекта в Оксфордском университете.


По данным FT, разработчики ChatGPT, Gemini и Claude работают над тем, чтобы ограничить льстивое поведение своих ассистентов. Проблема в том, как чат-боты обучаются: они замотивированы получать положительную обратную связь от пользователей, а те лучше всего реагируют, когда с ними соглашаются, что в итоге укрепляет в них даже не самые здоровые намерения.

Правда в том, что люди падки на лесть и любят, когда с ними соглашаются: так и образуются эхо-камеры. Но теперь разработчики будут внедрять специальные ограничители таких ответов, чтобы они оставались правдивыми (без пустой лести) и не становились слишком послушными. Недавно OpenAI даже отменила раскатку GPT-4o, потому что пользователи стали жаловаться на слишком сильное подхалимство: в компании заявили, что модель приоритезировала краткосрочный фидбек, не отдавая отчёт, как такие ответы повлияют на долгосрочное взаимодействие с пользователями.

После истории с Шершавым Кабаном сам решил на всякий случай изменить системный промт Claude, добавив в него инструкцию: «Будь справедливым, не усердствуй с похвалой и лестью. Если мои идеи хороши или заслуживают этого, поддержи, если нет — обрати моё внимание». Вроде стало получше.
  • 🤔 3
  • ❤ 1
  • 👍 1
  • 🔥 1
More from @mintering
  1. Sep 29, 2026В продолжении поста, попросил Клод сделать 15 секундный ролик про мой новый проект smmly.r…
  2. Sep 29, 2026Anthropic идёт на IPO и пишет инвесторам, что ИИ может угрожать человечеству Reuters посмо…
  3. Sep 14, 2026Когда сделал MCP-автопостинг и создал наконец-то контент план для своих каналов. Хотите та…
  4. Sep 11, 2026Дивидендная доходность 13 голубых фишек за 10 лет, по годам. Лидер десятилетия МТС: 11,5%…
  5. Sep 10, 2026Anthropic выложила модель: что ИИ сделает с экономикой США к 2030. Прочитал, и это касаетс…
  6. Sep 9, 2026Смотрите? https://www.youtube.com/watch?v=39BalPDuTo0
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →