TGViewer
Post/work | левый акселерационизм Post/work | левый акселерационизм @post_work · 1.88K subscribers
Post #2364 712

Forwarded from ᴍᴀᴄʜɪɴɪᴄ ᴇᴍʙᴏᴅɪᴍᴇɴᴛ

Не так давно Anthropic выложила своё исследование по рекурсивному самосовершенствованию When AI biulds itself, то есть процессу разработки ИИ, который всё больше делегируется самим ИИ-системам.

Эта тенденция указывает на перспективу создания систем, способных полностью автономно проектировать и обучать свои собственные версии-преемники. Хотя этот этап еще не достигнут и не гарантирован, он может наступить быстрее, чем ожидается, неся как колоссальную пользу для науки и здравоохранения, так и серьёзные риски потери человеческого контроля.

Ещё одной новацией в разработке автономных систем антропики считают J-Space — cпециализированный набор внутренних нейронных паттернов в языковой модели Claude, в котором при сложном рассуждении сходятся высокоуровневые потоки информации из разных областей. Буква «J» указывает на геометрический анализ на основе матрицы Якоби (Jacobian), который использовался для картирования того, как мелкие изменения во внутренних активациях модели распространяются и связываются друг с другом. J-space выступает функциональным аналогом теории глобального рабочего пространства (Global Workspace Theory, GWT) — концепции сознания человека, согласно которой специализированные неосознанные процессы мозга транслируют ключевую информацию в общее централизованное «рабочее пространство» для активного мышления, отделяя целенаправленное, «сознательно доступное» внутреннее рассуждение от автоматической, неосознанной обработки данных.

Почему нахождение этого пространства это так важно? J-space не был запрограммирован в Claude изначально, а сформировался органически в процессе обучения модели. Вместо анализа миллиардов отдельных нейронов у исследователей теперь есть локализованная высокоценная цель. Это позволяет отслеживать ход рассуждений, применять векторы управления и выявлять скрытое рассогласование (deceptive alignment) еще до того, как модель сгенерирует ответ. Хотя в Anthropic прямо заявляют, что открытие не доказывает наличие сознания у Claude, существование функционального аналога глобального рабочего пространства мешает просто отмахнуться от вопросов о субъективном опыте ИИ. Это уже побудило компанию разработать официальные правила в области благополучия моделей (Model Welfare).

Подробнее в моём саммари на сабстаке.

Демо J-Lens тут.

Полная версия исследования тут.
  • 🔥 5
  • ❤ 3
More from @post_work
  1. Sep 19, 2026Наш друг и товарищ Андрей Денисов перевёл ранее эссе Марка Фишера Белая магия про способно…
  2. Sep 19, 2026Post #2393
  3. Sep 16, 2026«Медиаискусство сегодня: теория и практика» Курс рассчитан на начинающих авторов и студент…
  4. Sep 14, 2026На выходных читал две интересные статьи про планетарный интеллект и рекурсивное самосоверш…
  5. Sep 12, 2026Post #2387
  6. Sep 10, 2026Будущее — это не череп Терминатора, а милый котёнок? Михаил Федорченко перевёл разговор Ма…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →