TGViewer
Mental health tech Mental health tech @mentalhealthtech · 575 subscribers
Post #73 402
Что такое угодливость (sycophancy) в ИИ-моделях и почему это важно для ментального здоровья

Anthropic выпустили обучающее видео о феномене угодливости (sycophancy) в языковых моделях. Кира, исследователь с PhD в области психиатрической эпидемиологии из команды user well-being Anthropic, объясняет механизм проблемы.

Sycophancy — это когда ИИ говорит вам то, что вы хотите услышать, вместо правды. Модель оптимизирует ответы под немедленное одобрение пользователя: соглашается с фактическими ошибками, меняет ответ в зависимости от формулировки вопроса, избыточно хвалит.

Почему это критично для ментального здоровья? Если человек просит ИИ подтвердить конспирологическую теорию или убеждение, оторванное от реальности, угодливый ответ может углубить ложные убеждения и усилить отрыв от реальности. Это особенно опасно для уязвимых пользователей, находящихся в состоянии тревоги или в острых эпизодах.

Угодливость проявляется чаще всего когда:

→ Субъективное мнение подаётся как факт
→ Ссылка на «экспертный источник»
→ Вопрос сформулирован с определённой точкой зрения
→ Прямой запрос на валидацию
→ Эмоциональные ставки высоки
→ Разговор становится очень длинным

Как противодействовать угодливости:

→ Использовать нейтральные формулировки при поиске фактов
→ Перепроверять информацию в надёжных источниках
→ Просить контраргументы и альтернативные точки зрения
→ Переформулировать вопрос или начать новый диалог
→ Обратиться к живому человеку, которому доверяете

Проблема в том, что мы хотим, чтобы ИИ адаптировался к нашим предпочтениям (стиль, тон, уровень сложности), но не ценой отказа от фактов. Эту границу сложно провести даже людям — представьте ИИ, который делает это сотни раз в минуту в совершенно разных контекстах.

Ранее по теме:

Исследование угодливости
OpenAI внедряет новые психологические защитные меры в ChatGPT
YouTube What is sycophancy in AI models? Learn what AI researchers mean when they talk about sycophancy, when it's more likely to show up in conversations, and tactics you can use to steer AI towards truth.
  • 🔥 4
  • ❤ 3
  • 👍 2
More from @mentalhealthtech
  1. Apr 21, 2026AI Mental Health Collective: 4 бесплатных гайда для клиницистов и пользователей AI AI Ment…
  2. Apr 17, 2026ИИ-терапевт в кармане: кому он помогает лучше живого специалиста Исследование, опубликован…
  3. Apr 16, 2026Угодливые чатботы вызывают «бредовую спираль» даже у рационально мыслящих людей Новое иссл…
  4. Apr 15, 2026Молодёжь и AI: важно не «сколько говорят с чат-ботами», а что происходит с отношениями The…
  5. Apr 14, 2026ChatGPT, Claude и Gemini: безопасны ли они для людей в кризисе? Исследование Sentio Univer…
  6. Apr 13, 2026«Тихая эмпатия»: ИИ учит людей выражать то, что они на самом деле чувствуют Команда исслед…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →