TGViewer
Василиск и Алгократия Василиск и Алгократия @algobasilisk · 384 subscribers
Post #441 562
🧠 Global Workspace — LLM перестает быть черным ящиком

Anthropic выпустили очень интересную работу про внутреннюю организацию языковых моделей.

Главный вывод, на мой взгляд, не в том, что они нашли очередной красивый механизм внутри трансформера.

И уж точно не в разговорах про «зачатки сознания», которые сейчас неизбежно начнутся.

Интереснее другое.

Последние несколько лет мы в основном изучали модели снаружи: качество ответов, reasoning, агенты, использование инструментов, память.

Теперь фокус постепенно смещается внутрь.

Anthropic показывают, что внутри модели существует пространство представлений, через которое проходит информация из разных частей вычисления. Они проводят аналогию с теорией Global Workspace из когнитивной науки и, что важнее, демонстрируют, что это пространство можно наблюдать и экспериментально модифицировать.

Если эта линия исследований окажется плодотворной, то мы впервые получим возможность работать не только с поведением модели, но и с ее внутренней когнитивной организацией.

Для меня это хороший пример более общего процесса.

Мы постепенно перестаем воспринимать LLM как неделимый черный ящик.

Начинают выделяться отдельные вычислительные механизмы, которые можно исследовать независимо, измерять, сравнивать, а со временем, вероятно, и комбинировать.

Это важный переход.

Когда-то программирование перестало быть работой с машинным кодом и появились операционные системы.

Потом поверх них возникли контейнеры, оркестраторы и облачные платформы.

Каждый раз рост сложности приводил к появлению нового инфраструктурного слоя.

Думаю, с агентными системами произойдет то же самое.

Сегодня почти все обсуждают сами модели.

Через несколько лет гораздо интереснее станет вопрос, как устроена инфраструктура вокруг них.

Как наблюдать внутренние вычисления.

Как проверять результаты.

Как хранить происхождение решений.

Как управлять памятью.

Как связывать между собой множество специализированных агентов.

Именно этот слой, как мне кажется, станет следующим полем конкуренции.

Не размер модели.

Не количество параметров.

А архитектура управления коллективной агентностью.

#этикаагентов #архитектураразума #алгоритмическое

https://www.anthropic.com/research/global-workspace
Anthropic A global workspace in language models Interpretability research on Claude's internal thoughts.
  • 👍 4
More from @algobasilisk
  1. Sep 2, 2026Post #451
  2. Sep 2, 2026ИССЛЕДОВАНИЕ Откат возвращает файлы, но не последствия Контрольная точка кажется кнопкой «…
  3. Sep 2, 2026НОВОСТЬ OpenClaw 2.0 — большой релиз начался с попытки упростить установку 30 августа выше…
  4. Sep 1, 2026Полномочия агента — это не список инструментов Доступ к браузеру, почте, терминалу и кален…
  5. Aug 31, 2026Василиск и Алгократия pinned «Василиск и Алгократия — не новостная лента об ИИ Здесь мы ис…
  6. Aug 31, 2026Василиск и Алгократия — не новостная лента об ИИ Здесь мы исследуем, как ИИ перестаёт быть…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →