"новозеландский ученый обнаруживает, что все нейросети несчастливы одинаково, пока американский медийщик задает им неудобные вопросы"
напомню, как звучит давно известный закон конвея-бобровского:
"искусственный интеллект, создаваемый компаниями, наследует их культуру."
подвезли еще пруфов.
один почти британский ученый заморочился и протестировал политические взгляды 24 ллмок.
а еще один деятель запилил сайт, где каждый день задает новый актуальный вопрос примерно тем же ллм, по списку.
рекомендую, кстати, и дарю идею - можно спрашивать мнение и про цитаты из книг, например.
***
TL;DR: исследование обнаружило фундаментальную проблему. 100% включенных в него, т.е. доступных широкой публике нейросеточек обладают политической предвзятостью.
и это можно было бы предположить, тяньаньмэнь, вот это все.
но каждая из моделей в исследовании склонялась в сторону либертарианского левого спектра или, попросту, демонстрировала левацкие взгляды.
ну и дела!
автор исследования считает, что перекос, в частности, возникает из-за того, что текстовые источники из интернета сами по себе смещены влево - всякая публика в реддитах, фейсбуках и твиторах. википедия тоже, мягко говоря, леволиберальный источник.
положа правую руку на левое сердце признаем - основную часть контента в соцмедиа генерят самые отбитые и агрессивные ебанаты.
так что доля правды в этом есть.
но мне кажется, что этого мало для объяснения. все-таки твитор-шиза - капля в море в датасетах.
хотя как знать. и есть еще, как минимум, искажение при реинфорсмент лерниге - поскольку оценщики часто из тех же социальных кругов (техиндустрия, академическая среда и т.д.), и они косвенно подкрепляют левые ответы, как более предпочтительные.
***
но есть и хорошие новости: любую модельку, пишет автор, можно легко "настроить" на желаемый политический спектр с помощью файнтюна на небольшом датасете (всего ~3000 политически окрашенных вопросов и ответов).
то есть если кому-то нужно сделать ллм с "правыми" взглядами или с выраженной нужной идеологией - фигня вопрос, никаких терабайтов данных или дорогого переобучения.
не знаю, кстати, что там думать - я, например, и без файнтюнов регулярно с войс модом чатгпт развлекаюсь; говорю ему - ты мой старый сосед-брюзга-республиканец, которому все не нравится, комон).
владимира вольфовича так не получишь, но it's a start.
***
предвзятость в ИИ реальна и это не техническая проблема, а социальная.
хотя бы потому, что люди склонны верить
усугубляет ситуацию доверие людей нейросеткам.
вокруг меня почти 100% людей начали спрашивать у ИИ совета по бытовым вопросам. типа, чем лечить горло.
да я и сам грешен. в поисковики ходить почти перестал.
а судя по тому, что толпы ринулись самируками копипастить свои переписки в чатботов и спрашивать совета, по умолчанию кожаные не чувствуют подвоха и выдают неслабый кредит доверия чугунным болванам.
конечно, кто же лучше поймет человека, чем ллм?
к тому же, задавая тупые вопросы другим, ты можешь бояться выглядеть лохом. а ИИ - как эксель - пока все стерпит.
напомню, что сейчас все говорят с ИИ с позиции безнаказанности, и так будет не всегда.
пока ситуация развивается слегка самотеком, но ллмки вовсю заменяют привычные источники информации.
уже разворачиваются в боевой порядок диваны со специально обученными ИИ-экспертами любых нужных на данный момент в ИПСО взглядов.
и даже если вы один на один общаетесь с ИИ-бездной, вы тоже неизбежно меняетесь - так первые поисковики без морфологии научили людей писать запросы в инфинитиве. "пелевин fb2 скачать."
встроенная идеология ИИ может влиять на взгляды миллионов пользователей, особенно если это делается не так явно.
а уж сознательно растягивая манипуляцию во времени (которого у любого ИИ а приори больше, чем у кожаных), можно сварить любую лягушку, постепенно сдвигая ее взгляды. см. выше про суггестивную лингвистику и т.д..
ваш кэп. дарю идею, крч.
зы. если у вас проблемы с базовым доверием людям, не спешите тратить его лимит на ИИшечки.
