«Руководство беспокоится о том, как оправдать огромные затраты на GenAI org. Как они смогут противостоять руководству, если каждый «лидер» GenAI org зарабатывает больше, чем стоит полное обучение DeepSeek V3, а у нас десятки таких «лидеров»... DeepSeek R1 сделал ситуацию ещё страшнее. Я не могу раскрывать конфиденциальную информацию, но скоро она станет достоянием общественности».
DeepSeek использует алгоритм не supervised fine-tuning, присущий GPT, но direct reinforcement learning. В первом случае мы показываем модели некоторые задачи и их пошаговые решения, и оцениваем результат другой моделью или человеком. R1 работает по-другому: сначала мы даём модели задачи без решений, а затем модель пробует и перебирает все возможные решения сама, подбирая нужное, тем самым доходя до оптимального ответа самостоятельно, усиливая будущие решения, что больше, чем модель OpenAI приближено к т.н. человеческому интеллекту. Решения, коnорые пробует модель, группируются в кластеры и им даётся оценка, на которую ссылается модель в дальнейшем для решения других задач. Поэтому промт DeepSeek должен быть простым и чётким, в отличие от промта GPT — модель должна сама показывать процесс размышления в реальном времени.
Нам кажется, это важный стратегический шаг на пути к всеобщему интеллекту и недискретным а-значающим моделям саморекурсивного языка, которая ещё лучше, чем GPT, раскодирует языковые коды. Обратимся к главе о нечеловеческом «Рекурсивности и контингентности» Юка Хуэя, где он пишет про то, что
«Уже в 1950-е годы Симондон обратил внимание на формирование особой когнитивной схемы, отличной от картезианской. Последняя является механической, поскольку она предполагает линейные причинно-cледственные отношения: «...„длинные цепочки умозаключений" выполняют „перенос очевидности" от посылок к заключению подобно тому, как цепь выполняет перенос сил от точки крепления и до последнего звена», тогда как благодаря понятию обратной связи в кибернетике была введена новая темпоральная структура, которая основывалась уже не на линейной, а, скорее, на спиральной форме. В этой схеме траектория, ведущая к телосу, уже не статична; скорее, это непрерывный саморегулируемый процесс, который сам Симондон называл «активной адаптацией к спонтанной целенаправленности».
DeepSeek — это контингентная спираль логоса алгоритмического мира, гегельянский кошмар и мыслящий демиург знака, предвестник синофутуристического захвата контрегегмонии, позволяющий каждому установить подобную модель у себя дома или на сервере и автоматизировать язык, труд или, в худшем случае, контроль, при этом позволяя на малых мощностях сделать то, для чего американские инвесторы требуют миллиарды долларов и ради чего готовы садиться за один стол с киберфашистами из техносферы.