Попытки смоделировать ум / сознание имеют долгую историю. Магистральная линия западной традиции — от Аристотеля до Канта — тяготела к тому, чтобы представлять мышление с опорой на языковой прототип, причем в его графической, линейной и дискретной форме (в отличие, например, от звука, жестикуляции или идеограмм). В такой модели знание — это утвердительное предложение («суждение») и даже не всякое утвердительное предложение, а базовое предложение структуры «S есть P», т. е. любое предложение в конечном счете может быть сведено к этому базовому (обе презумпции совершенно неправдоподобны, если рассматривать их с точки зрения лингвистической типологии; не говоря о том, что бытийная связка имеется далеко не во всех языках); это — «нейтральное», сухое предложение, оно (якобы) деконтекстуализировано, у него нет интонации, акцентов, тонов, тембра, прагматики. Мышление — по крайней мере, дискурсивное мышление — есть оперирование такими «суждениями» по определенным линейным «законам», которые конструируются путем отвлечения от синтагматических структур, используемых в данном философском кружке и считающихся там образцовыми (то, что основное население по этим «законам» не мыслит, было понятно с самого начала). Несмотря на то что «правильное» / «логосное» мышление здесь можно «просчитать», отличив его от неправильного / нелогосного мышления, де-факто это не привело к единообразию мысли, а даже напротив, вызвало широкое разнообразие, т. е. на практике модель не работала — у такого «правильного» мышления просто не было носителя.
Данный факт обескураживал некоторых новоевропейских философов, которые, вдохновившись успехами математики и механики, попытались
На мой взгляд, этот (неявный) графо-лингво-центризм и редукционизм — хотя и укоренен в интроспекции (в таком универсальном аспекте мышления, как внутренняя речь) и особенностях западной визуальной культуры — всё же тотально ошибочен: так нельзя описать и понять не только реальное мышление, но и реальный, живой язык (и даже письменный язык, особенно с идеографическим письмом), что, среди прочего, показано в многочисленных трудах энактивистов, когнитивных лингвистов и лингвистов-антропологов. Однако теперь в ретроспективе ясно, что у этого проекта имелось более важное измерение — инструментальное: вера в возможность смоделировать мышление побуждала философов и инженеров создавать физические устройства, которые с разной степенью успешности справлялись с «интеллектуальными» задачами. И если до Нового времени это были единичные случаи от маргиналов (таких как Раймунд Луллий), то с XVII в. это стало тенденцией («Паскалина» Б. Паскаля, арифмометр Г. Лейбница, «Считающие часы» В. Шиккарда), а впоследствии — по мере роста технонауки — привело к формированию особого интеллектуального «цикла». Если и существует хитрость мирового разума, то она должна опираться именно на такую циклическую причинность: мы верим, что человеческое мышление подобно его наилучшему воплощению в данной культуре (алфавиту, диалогическому / диалектическому искусству, мельнице, механической машине, заводу, калькулятору, компьютеру) → это подталкивает нас к улучшению устройства или конструированию нового инструмента, берущего на себя часть «интеллектуальных» функций → мы начинаем верить, что человеческое мышление подобно этому улучшенному инструменту → улучшаем его с привлечением новых средств и т. д. (Как будто само мышление создает себе техническую плоть!)
Что в таком случае мы бы ожидали после появления довольно успешных искусственных (квази)нейросетей c архитектурой трансформеров, таких как LLM? Правильно: объяснение человеческого мышления с помощью «механизмов» работы (квази)нейросетей. И хотя мы плохо понимаем, как они работают и почему у них появляются новые свойства, все же что-то мы понимаем: в частности, организация «знания» в LLM обычно описывается с помощью многомерного векторного пространства. И вот, в 2024 г. в авторитетном издании «Trends in Cognitive Science» выходит статья исследовательской группы под руководством С. Пьянтадози с таким названием: «Почему концепты (вероятно) являются векторами?». Согласно этой модели, концепт является точкой или вектором в высокоразмерном пространстве, и его «значение» раскрывается через геометрические отношения и вычислительную динамику с другими векторами. Авторы прямо утверждают, что на эту модель их вдохновили выстраиваемые в рамках LLM векторные пространства слов и фраз на основе статистических закономерностей их использования в текстах, причем, как они считают, получаемые векторы «поразительно точно» воспроизводят ключевые свойства и структуру человеческих концептов. Вся эта система описывается с помощью «семантики концептуальных ролей» и семантического интернализма, так что она не требует «привязки» к реальному миру: значение любого символа или вектора полностью определяется той вычислительной и функциональной ролью, которую тот играет во внутренней системе отношений с другими элементами. Вспоминая соссюровское «в языке нет ничего, кроме различия», я бы предложил называть такой подход «неоструктурализмом» — усложненной формой математического представления, претендующей на выявление глубинных «структур» и менее прозрачной для неспециалистов, чем классические структуралистские реконструкции (сходная тенденция к смысловой непрозрачности обнаруживается в когнитивном музыковедении).
Вероятно, в плане точности и предсказательной силы этот подход станет шагом вперед в сравнении с лингвоподобными репрезентациями в духе фодоровского «ментализа» (требовавшего, к тому же, признания врожденности значительной части концептуальной системы) и даже в сравнении с теорией «перцептивных символов», которую я частично поддерживаю в своих работах. В модели векторного пространства учтены разнообразие категорий, градиентность членства, радиальная структура, реляционность, мультимодальность, возможность формирования категорий ad hoc и многое другое, что описано когнитивными лингвистами на широком кросскультурном материале. Тем не менее, я думаю, век таких более-менее понятных реконструкций короток: концептуальная система человека (как и другие составляющие когнитивной системы) устроена — если здесь вообще применима архитектурная метафора — настолько сложно и разнопланово, что эта организация не может быть «представлена» или «помыслена» самим человеком; кроме того, ее нельзя «описать» вне отношений с восприятием, вниманием и экологическим контекстом, что существенно усложняет задачу. Полагаю, в рамках общенаучной тенденции к гиперинструментализму все подобные модели скоро будут заменены полностью непроницаемыми для человека гибкими ad hoc моделями, конструируемыми специально обученными нейросетями с целью последующего технологического использования. Звучит страшно? Но с другой стороны: может быть, перестав «моделировать» или «представлять» мышление, мы займемся самим мышлением?