TGViewer
ᴍᴀᴄʜɪɴɪᴄ ᴇᴍʙᴏᴅɪᴍᴇɴᴛ ᴍᴀᴄʜɪɴɪᴄ ᴇᴍʙᴏᴅɪᴍᴇɴᴛ @acceleratethefuture · 2.21K subscribers
Post #964 1.8K
Не так давно Anthropic выложила своё исследование по рекурсивному самосовершенствованию When AI biulds itself, то есть процессу разработки ИИ, который всё больше делегируется самим ИИ-системам.

Эта тенденция указывает на перспективу создания систем, способных полностью автономно проектировать и обучать свои собственные версии-преемники. Хотя этот этап еще не достигнут и не гарантирован, он может наступить быстрее, чем ожидается, неся как колоссальную пользу для науки и здравоохранения, так и серьёзные риски потери человеческого контроля.

Ещё одной новацией в разработке автономных систем антропики считают J-Space — cпециализированный набор внутренних нейронных паттернов в языковой модели Claude, в котором при сложном рассуждении сходятся высокоуровневые потоки информации из разных областей. Буква «J» указывает на геометрический анализ на основе матрицы Якоби (Jacobian), который использовался для картирования того, как мелкие изменения во внутренних активациях модели распространяются и связываются друг с другом. J-space выступает функциональным аналогом теории глобального рабочего пространства (Global Workspace Theory, GWT) — концепции сознания человека, согласно которой специализированные неосознанные процессы мозга транслируют ключевую информацию в общее централизованное «рабочее пространство» для активного мышления, отделяя целенаправленное, «сознательно доступное» внутреннее рассуждение от автоматической, неосознанной обработки данных.

Почему нахождение этого пространства это так важно? J-space не был запрограммирован в Claude изначально, а сформировался органически в процессе обучения модели. Вместо анализа миллиардов отдельных нейронов у исследователей теперь есть локализованная высокоценная цель. Это позволяет отслеживать ход рассуждений, применять векторы управления и выявлять скрытое рассогласование (deceptive alignment) еще до того, как модель сгенерирует ответ. Хотя в Anthropic прямо заявляют, что открытие не доказывает наличие сознания у Claude, существование функционального аналога глобального рабочего пространства мешает просто отмахнуться от вопросов о субъективном опыте ИИ. Это уже побудило компанию разработать официальные правила в области благополучия моделей (Model Welfare).

Подробнее в моём саммари на сабстаке.

Демо J-Lens тут.

Полная версия исследования тут.
  • 🔥 3
  • 🍓 1
More from @acceleratethefuture
  1. Sep 20, 2026В статье Маттео Пасквинелли Machine, organism and language: a comparative epistemology of…
  2. Sep 19, 2026Наш друг и товарищ Андрей Денисов перевёл ранее эссе Марка Фишера Белая магия про способно…
  3. Sep 19, 2026Снова о генеративном искусстве. Статья Generative AI as a Philosophical Mirror: Machine Ha…
  4. Sep 18, 2026Советую посмотреть сегодня вечером лекцию подкаста Wandering Thoughts о биоэлектричестве,…
  5. Sep 17, 2026А мне сегодня 32 года. Я каждый год испытываю сложность с процессом написания и подведения…
  6. Sep 16, 2026«Медиаискусство сегодня: теория и практика» Курс рассчитан на начинающих авторов и студент…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →