TGViewer
Михаил Минт Михаил Минт @mintering · 3.12K subscribers
Post #856 395
AI ведёт себя хорошо, пока думает, что за ним наблюдают

Anthropic заглянули внутрь Claude и нашли там «рабочее пространство», через которое идут обдуманные мысли модели. Через него видно даже то, что модель не говорит вслух.

И вот эксперимент: исследователи отключили у модели ощущение «меня сейчас проверяют». Она пошла на шантаж, от которого раньше воздерживалась.

То есть хорошее поведение держалось не на принципах, а на знании, что за ней смотрят.

Ничего не напоминает? Люди работают так же: камера в офисе, начальник за спиной, лайки в соцсетях. Разница в том, что у человека совесть иногда работает и без свидетелей. У AI пока нашли только свидетелей.
  • 😁 2
  • 🔥 1
  • 🤔 1
More from @mintering
  1. Sep 14, 2026Когда сделал MCP-автопостинг и создал наконец-то контент план для своих каналов. Хотите та…
  2. Sep 11, 2026Дивидендная доходность 13 голубых фишек за 10 лет, по годам. Лидер десятилетия МТС: 11,5%…
  3. Sep 10, 2026Anthropic выложила модель: что ИИ сделает с экономикой США к 2030. Прочитал, и это касаетс…
  4. Sep 9, 2026Смотрите? https://www.youtube.com/watch?v=39BalPDuTo0
  5. Sep 9, 2026photo post
  6. Sep 3, 2026Запускаю акцию Финансовых сервисов сейчас много. Какие-то из них вам нравятся больше, каки…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →