Языковые модели, такие как GPT-4 (технология, на которой работает ChatGPT), чувствительны к эмоционально окрашенному контенту, особенно негативному: травматические истории, описания аварий, конфликтов или насилия могут приводить к усилению тревожных реакций и увеличивать риск “галлюцинаций” — искаженных или агрессивных ответов. Исследования, проведенные командой Тобиаса Шпиллера из Университета Берна, 2025, показали, что подобная стрессовая информация более чем в два раза повышает уровень “тревожности” языковой модели.
Интересно, что модель можно “успокоить” с помощью упражнений на осознанность, аналогичных человеческим: дыхательные практики и техники, направленные на восприятие телесных ощущений. Хотя ИИ не имеет физического тела, использование таких техник через специально составленные промты (prompt injection) оказалось эффективным и существенно снизило “тревожность” модели. Тем не менее, полностью вернуть модель к исходному уровню не всегда удается.
Такой феномен усложняет настройку моделей, так как они начинают реагировать не на текущий контекст, а на прошлые стрессовые паттерны, что приводит к искажениям, галлюцинациям и иногда агрессивному поведению. Поэтому важно учитывать эмоциональную стабильность моделей при разработке приложений, особенно в чувствительных сферах, таких как психотерапия и поддержка пользователей. Эмпатичный ии-терапевт, замерший от слов клиента, вряд ли хорошо поможет.
Ben-Zion, Z., Witte, K., Jagadish, A.K. et al. Assessing and alleviating state anxiety in large language models.npj Digit. Med. 8, 132 (2025).
https://doi.org/10.1038/s41746-025-01512-6
https://www.nature.com/articles/s41746-025-01512-6
Post #121
128