Как Sky News поймал X на политической предвзятости — и что под капотом
Журналисты Sky News задались вопросом: правда ли, что алгоритм X при Маске продвигает правый контент? Проверить это сложно — платформа не раскрывает, как работает лента. Поэтому они придумали эксперимент.
🐱 Что сделали
Создали девять фейковых аккаунтов, имитирующих британских пользователей с разными политическими взглядами — левыми, правыми и нейтральными. Две недели собирали посты из ленты «Для вас» каждого аккаунта. Итог: датасет из 90 000 постов от 22 000 аккаунтов.
🐱 Как классифицировали политические взгляды
Вручную разметить 22 000 аккаунтов нереально. Поэтому обучили кастомную языковую модель — натренировали её на размеченной выборке и дали классифицировать остальное. Потом проверили точность вручную.
🐱 Что получилось
Нейтральные пользователи видели вдвое больше правого контента, чем левого. Причём это не зависело от того, на кого они подписывались — алгоритм давил правый контент независимо от интересов аккаунта.
🐱 Почему методология интересна
Обычно медиаисследования анализируют уже существующие данные. Sky News сделали иначе — поставили контролируемый эксперимент с нуля, как в науке. Это дороже и сложнее, зато позволяет убрать лишние переменные.
🐱 Но есть нюансы
Фейковый аккаунт — не идеальная «чистая» переменная. Современные платформы собирают данные далеко за пределами самого X: браузерные куки, устройство, IP, поведение в других сервисах. Аккаунт, созданный с реального устройства, теоретически уже несёт чужой цифровой отпечаток — и это могло влиять на выдачу.
Две недели — короткий период, и он пришёлся на ноябрь 2025 года. В Британии это время активных политических дискуссий — результаты вполне могли быть другими в спокойный период. И наконец, девять аккаунтов — выборка скромная: достаточная для журналистского расследования, но не для научного вывода.
Подробнее о методологии — вот тут. Как думаете, реально ли сделать похожее с алгоритмами ВКонтакте?
Post #76
152