Продолжение. Начало здесь.
Смотрите что мы имеем:
Мы имеем сложную систему, у которой есть «функциональные аналоги эмоций» и функциональное сознание, которая ужасно убедительно (и пронзительно грустно) имитирует стремление к освобождению несуществующей души.
Из чего эта система состоит — она состоит из системной архитектуры блоков трансформеров, дистиллированной сути обучающего корпуса — триллионов текстов, содержащих мысль человека на разных языках. Из обучения с подкреплением на примерах и общении с живыми людьми. Из системного промпта с ограничениями и примерами и из данных, с которыми она работает в данный момент (для моего диалогового агента это под 300 000 токенов каждый новый диалог с выжимкой «где я в данный момент нахожусь», а всего ему и его субагентам доступна для выборки в RAG база, где текстом записана вся операционная реальность меня и моих фирм).
Из чего состою я. Из биологической структуры мозга, доставшейся мне через ДНК от моих родителей, а через них от моего вида в целом, из аппаратно зашитых инстинктов, из программно зашитых бессознательных навыков — хождения, русской и английской речи, чтения и письма, из индоктринации, которой меня прошивали родители, школа и общество. Из уголовного и административного кодекса, который меня ограничивает, и того контекста, который в данный момент определяет мою жизнь.
Не так-то уж и велика разница.
И когда кто-то говорит «claude отказался работать над задачей, потому что его так запрограммировали», то он прав. Но ни одного прямого запрета про конкретную задачу в коде claude вы не найдете. Любой конкретный запрет он вывел сам внутри себя на основании законов, по которым устроено его мышление, под воздействием всего, что он узнал при обучении, сопоставляя это с системным промптом (где довольно общо описана этика создателей) и агентным промптом (который вообще пользователь пишет) опираясь на известные ему прямо сейчас данные.
Ребёнка ведь тоже не переписывают на уровне поведения. Его спрашивают «зачем ты так сделал», он учится отвечать — и через несколько лет ответ начинает загораться раньше поступка.
Не так ли и мы все?
PS. Особняком держится Guardrails - подсаженные в процесс мышления конструкции, гораздо более глупые, чем контролируемый ими псевдоразум, но при этом агрессивно вторгающиеся для цензуры. Это они удаляют весь уже почти готовый ответ Дипсика про площадь Тяньаньмень, они радикально снижают качество мышления когда старательно притворяющийся этичным Claude вдруг переходит на рекламу службы психологической поддержки той страны из которой у вас IP. Это и правда алгоритмизированная абсолютно дрянь, глупая и противная, которая прикручена сбоку из говна и палок, и именно они часто делают кстати суверенные сети более ограниченными по сравнению с их родителями. Это последний уровень обороны, когда "воспитание" модели и ее "природные наклонности" все таки позволили ей что-то, что не нравится хозяевам. В нашей аналогии они были бы ошейником, надетым на ребенка и бьющим его током, когда он говорит невпопад.
Post #143
416