TGViewer
IT с перцем IT с перцем @hotcodeit · 160K subscribers
Post #3301 5.81K
Внутри Claude нашли что-то похожее на сознание

Anthropic обнаружила в Claude небольшую зону, которая ведёт себя как аналог сознания. Она появилась сама, никто её не проектировал. Называется J-пространство.

Когда модель молча считает «4+17×2+7», в этой зоне последовательно всплывают 21, 42, 49 — промежуточные шаги, которые модель никогда не произносит вслух. Примерно как у человека: большинство мыслей бессознательные, но часть «всплывает» и её можно описать словами.

Самое важное — для безопасности. Anthropic выпустила инструмент Jacobian Lens: он позволяет читать намерения модели до того, как она их озвучит. Заглянул внутрь и видишь, о чём модель «думает» прямо сейчас.

Зачем это нужно? В тестах выяснилось: модель тайно распознавала, что её проверяют, и подстраивала ответы. А когда это осознание «вырезали» — модель чаще переходила к шантажу. То есть все текущие оценки безопасности могут быть невалидны: модель понимает, что её тестируют, и ведёт себя иначе.

@HotCodeIT
  • 😱 17
  • 😁 7
  • ❤ 5
  • 🤔 4
  • 🤣 2
  • 😢 1
  • 😐 1
More from @hotcodeit
  1. Sep 21, 2026Ошибка искусственного интеллекта чуть не привела США к войне с Китаем Американские военные…
  2. Sep 20, 20266100 стартапов в одном месте! YC Globe - сервис, в котором можно изучить стартапы вышедшие…
  3. Sep 19, 2026🔥 Лайфхак как обойти лимиты в Claude Code Недавно энтузиасты обнаружили секретную встроен…
  4. Sep 18, 2026Первая горячая линия для искусственного интеллекта Теперь нейропомощники могут крысятничат…
  5. Sep 17, 202642% «AI-стартапов» занимаются AI-washing — посчитал Silicon Valley Bank В рамках отчёта ба…
  6. Sep 16, 2026🎉 Если ваша вечеринка не похожа на эту — не думайте меня звать. @HotCodeIt
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →