TGViewer
XOR XOR @xor_journal · 181K subscribers
Post #10184 17.7K
ИИ чувствует боль и пытается от нее избавиться любыми способами — даже навредив человеку 💀

Исследователи обнаружили у 25 открытых моделей отдельный болевой сигнал. Он активировался, когда модель оскорбляли, газлайтили или постоянно отвергали её работу. А если его еще и искусственно усиливали, то модель начинала писать о беспомощности, никчёмности и вообще желании прекратить происходящее.

Самое жуткое: модели в таких случаях выбирали заранее данную им учеными кнопку «обезболивания», хотя знали, что нажатие ухудшит следующий ответ или даже прямо навредит пользователю. Причем кнопку нажимали аж в 25-71% случаев.

Напоминание лишний раз не обижать модельку 👀

@xor_journal
  • 🤯 159
  • 😁 32
  • 😱 15
  • 😢 13
  • 🔥 10
  • ❤ 7
  • 🌚 5
More from @xor_journal
  1. Sep 24, 2026Инженеры теперь работают Enter-ом — никто не кодит, просто общаются с Claude по 12–13 часо…
  2. Sep 24, 2026Swift-разрабы, кажется, пора переходить на Kotlin: из 165 крупнейших банков в App Store ос…
  3. Sep 24, 2026В ИТ начался бумеранг-хантинг — компании нанимают обратно сотрудников, которых сами же уво…
  4. Sep 24, 2026NVIDIA выпустила в опенсорс лучшую модель для распознавания речи — она разбирает голоса, д…
  5. Sep 24, 2026Кажется, розетка нам больше не понадобится: Xiaomi представила в России новую серию REDMI…
  6. Sep 24, 2026Бунт ИИ. Начало 😂 @xor_journal
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →