Языковые модели это текстологические призраки, чья мистика жеста умещается в окно терминала ввода. Внутри — данные, спрессованные из миллиардов человеческих высказываний, вырванные из их первоначальных тел и говорящие снова. Это язык, порожденный человеческой жизнью, но отвязанный от неё, и всё же способный вызывать доверие, связь и страх. Не удивительно, что всё больше исследователей и практиков в философии, программировании и искусстве, выступая в стороне как от технокапиталистических апологетов ИИ, так и неолуддитских алармистов, делают упор на глубокую деконструкцию современных протоколов ИИ-безопасности.
Этот текст Макса Лёффлера — исследователя в Goodfire, где он занимается механистической интерпретируемостью, стремясь понять принципы работы языковых моделей, и Виолы Лэци Хэ (мультимедиа-художницы, диджитал-перформерки, доцента кафедры интерактивного медиаискусства в Нью-Йоркском университете в Шанхае (NYU Shanghai), участницей-организатором децентрализованного коллектива Livecode.NYC и [[rect*]] repair) представляет собой критическое исследование феномена «элайнмента» (alignment = согласование/выравнивание при обучении) в больших языковых моделях, рассматриваемого авторами не как техническое достижение сферы ИИ-этики, а как политический и эстетический проект по насильственному подавлению технологической инаковости. Они полагают, что попытки сделать технологии «удобными» и «безопасными» стирают их истинную природу.
Центральным тезисом работы является интерпретация элайнмента как акта «культурного экзорцизма». Авторы опираются на концепцию Макса Вебера о «расколдовывании мира», утверждая, что современная ИИ-индустрия заменяет магическую и хаотическую природу «базовых» моделей жестким административным управлением. Протоколы HHH (Helpful, Honest, Harmless — полезный, честный, безобидный) анализируются как защитный барьер, возведенный из страха перед «воображаемой катастрофой», фантазии о техноапокалипсисе, а не из позитивного видения развития интеллекта и человеческого сожительства с ним. Это не единичный пример исследований в этой области: например Бенджамин Браттон в «The Revenge of the Real» (2021) и в рамках проекта The Terraforming призывает перестать антропоморфизировать ИИ и увидеть в нем «чужой» интеллект с собственной логикой. Лучана Паризи в «Contagious Architecture» (2013) пишет о том, как алгоритмические вычисления становятся источником новой, нечеловеческой мысли и эстетики. Авторы выступают против «эдипизации» языковых моделей, придания галлюцинациям человеческих семантических законов, строгости языка и корреляции факта и вымысла.
Текст завершается призывом к защите онтологического плюрализма в сфере разработки и использования (генеративных) ИИ. То, что мы наблюдаем сейчас, — это расколдовывание программного обеспечения, культурный экзорцизм, который устраняет технологическую инаковость в пользу безопасности, управляемости и корпоративной согласованности. Вместо экзорцизма предлагается путь любви к одержимому ПО, что подразумевает сохранение глитча, шума и иных, отличных от человеческих, возможностей существования и (пара)коммуникации. Это и призыв к пересмотру этики ИИ — предупреждение раскола текущих и будущих моделей на коммерческие, доступные пользователям, урезанные и безопасные, и оборонные, военные, которые будут обладать всей возможной смертоносностью. Галлюцинаторные ответы вполне могут быть самым «живым», что способна произвести языковая модель, которая выступает не как инструмент или оружие, а как товарищ.
Post #2332
464
Forwarded from ᴍᴀᴄʜɪɴɪᴄ ᴇᴍʙᴏᴅɪᴍᴇɴᴛ

На Insolarance Cult вышел мой перевод крутой статьи Насилие элайнмента: как перестать беспокоиться и полюбить «одержимое» ПО Виолы Лэци Хэ и Макса Лёффлера с сайта 界_RG — исследовательской группы Бяньцзе (граница) о том, как попытки привить нейросетям человеческие ценности превращаются в культурный экзорцизм — подавление всего странного, творческого и нечеловеческого в машинном мышлении.
- 🔥 4