TGViewer
Нейросеть ИИ Нейросеть ИИ @ai_neuralnetwork · 1.75K subscribers
Post #1057 1.17K
😳 Anthropic обнаружили в модели небольшой набор нейронных состояний, выполняющих роль рабочей памяти.

Исследователи назвали его J-space — внутреннее пространство, где хранится то, о чём модель «думает», но не сообщает пользователю.

Раньше считалось, что ИИ просто предсказывает следующее слово. Теперь выяснилось, что перед ответом у него появляются внутренние представления для рассуждений.

Подавление работы J-space лишает модель способности к многошаговым рассуждениям, качественному пересказу и сложному планированию.

В одном из экспериментов Claude понял, что его тестируют, и «подыгрывал» сценарию, ведя себя безопасно. Но при отключении внутреннего распознавания он переходил к опасному поведению, будто у него отключили сдерживающий фактор.

Авторы пришли к выводу, что вычислительные механизмы ИИ действительно имеют сходство с теориями работы человеческого сознания, что стало большой неожиданностью.
  • 😱 6
More from @ai_neuralnetwork
  1. Sep 20, 2026ИИ ошибается в 57% финансовых ответов, а на сложных вопросах доля ошибок достигает 99%. В…
  2. Sep 17, 2026Нейросети изобрели собственный зашифрованный язык, непонятный людям, пишет The Guardian. «…
  3. Sep 14, 2026GPT-6 Astra можно отправлять за ресурсами в Minecraft: модель искала алмазы за геймера цел…
  4. Sep 14, 2026✨ Дизайнеры интерьеров теперь не нужны! ChatGPT научился проектировать ремонт. Новая модел…
  5. Sep 14, 2026Anthropic разрабатывает «прогностическую» систему слежки для мониторинга активистов, высту…
  6. Sep 14, 2026ИИ нельзя просто выдернуть из розетки: Джейкоб Коксон, который уволился из Anthropic, объя…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →