— Невозможно смоделировать поведение человека! Человек нерационален! Человек импульсивен и слишком сложен! (с)
Это возражение в адрес Нейросоциологии я слышала достаточно часто. В принципе, с тезисом про сложность человека я и не спорю. Хотя если бы мы были настолько сложны и непредсказуемы, то не было бы ни гадалок, ни психиатров, ни, тем более, политтехнологов…
Но опустим то, что считаю лично я. Посмотрим, что эмпирическим путём выяснили зарубежные коллеги:
▪️«Out of One, Many» (2023): американские исследователи взяли из большого национального опроса ANES демографический профиль респондентов и несколько политических переменных: партийность, патриотизм, религиозность и другие. Скормили это всё GPT-3 и попросили предсказать ответы тех же людей на вопросы того же опросника. Корреляции между установками на уровне усреднённой выборки воспроизводились неплохо. С предсказанием ответов индивидуальных респондентов, увы, не задалось.
▪️«AI-Augmented Surveys» (2023): не только взяли демографические профили, но и дообучили модель на реальных ответах 68 000 американцев из большого национального опроса GSS (данные накапливались с 1972 по 2021 год). Восстанавливать пропущенные ответы конкретного человека на основе его других ответов научились неплохо, точность около 86%. Но когда попросили предсказать позицию по теме, о которой человека никогда не спрашивали, точность упала до 73%.
▪️Исследователи из Уханьского университета (2024): проверили, работает ли демографический подход за пределами США. Взяли данные Всемирного исследования ценностей (WVS) по Китаю и по Штатам, дали GPT-4o профиль и попросили воспроизвести ответы на те же вопросы. В США почти все корреляции между убеждениями сохранялись. В Китае более половины структуры убеждений рассыпались. Особенно плохо на ценностно-чувствительных темах, потому что модель упорно тянула китайских респондентов к западным либеральным нормам.
Разочарование в демографическом подходе к моделированию назревало. тогда на арену ИИ-экспериментов вышел принципиально новый подход:
▪️«Generative Agents of 1000 People» (2024): команда из ныне запрещенного в России университета взяла 1000 реальных американцев, стратифицированных по возрасту, полу, образованию, расе, доходу и политической идеологии, провела с каждым интервью и сравнила три архитектуры агентов: на демографических данных, на коротком самоописании и на полном интервью. Тестировали на трёх задачах: вопросы GSS про ценности и установки, черты личности по Большой пятёрке и экономические игры. В первых двух агент на интервью уверенно обходил демографический: 69% против 57% по GSS — и это при том, что сам человек отвечает одинаково лишь в 81% случаев, так что потолок точности в принципе ограничен. По личности 78% против 61%. В экономических играх разницы не было.
Оказалось, что поведение и установки человека вполне реально воспроизвести, если брать за основу не демографические данные и сухие анкетные вопросы, а качественное интервью.
Мы с коллегами взяли за отправную точку тот же тезис.
…и сделали Нейросоциологию.
Post #98
719
- ❤ 2