Оказалось, что после травматичных текстов тревожность GPT реально резко возрастала, почти в два раза превышая исходный уровень. Для проверки использовали человеческий тест на тревогу — тот самый, которым психологи оценивают состояние пациентов.
Чтобы сбить это, использовали техники расслабления и осознанности, которые обычно помогают людям: дыхательные упражнения и визуализацию природы. Это реально помогло снизить тревожность модели, хотя полностью убрать последствия травматичных текстов всё равно не удалось.
При этом нейтральный контент, вроде инструкций от пылесоса, никак не влиял на состояние LLM — тревога не повышалась и не снижалась.
Статья:
https://www.nature.com/articles/s41746-025-01512-6?utm_campaign=174170814598&utm_medium=email&utm_source=mailganer&utm_order_number=1
Сорцы:
https://github.com/akjagadish/gpt-trauma-induction
