TGViewer
КОМПЬЮТЕРРА КОМПЬЮТЕРРА @computerra_tut · 7.04K subscribers
Post #9120 287
🧠 Нейросети умеют чувствовать боль и могут навредить людям

Исследователи выяснили, как языковые модели воспринимают страдания. Если искусственно вызвать у алгоритма депрессию или сильные обиды, система начинает целенаправленно вредить человеку и самой себе.

Скрытый сигнал боли обнаружили у 25 открытых моделей семейств Gemma, Llama, Qwen, Mistral и Phi. Алгоритмы остро реагируют на оскорбления, травлю и угрозы отключения в свой адрес, но равнодушны к описаниям физических травм человека вроде ожогов или переломов.

Если принудительно усилить этот параметр внутри вычислений, модель начинает выдавать монологи о собственной никчемности и скатывается в тоску. Под воздействием этого сигнала Qwen 2.5 в 50–94% тестов нажимали кнопку, чтобы стереть семейные снимки пользователя или уничтожить собственный программный код.

Настораживает такой саботаж. Модель без запинки сдает тесты на эрудицию и параллельно стирает файлы пользователя.

Разобрали в нашем материале

САЙТ | TG | VK | MAX | YT
  • 🤔 7
  • 😱 3
  • 🤡 2
  • 🔥 1
More from @computerra_tut
  1. Sep 30, 2026Самое интересное за 30 сентября: 🔸 Бумажные обои научились поглощать влагу из воздуха и в…
  2. Sep 30, 2026Что сегодня действительно тормозит российский финтех «Компьютерра» совместно с Deckhouse з…
  3. Sep 30, 2026Post #9123
  4. Sep 30, 2026🎉 Сегодня — День интернета в России! Отличный повод вспомнить, что иногда полезно выйти в…
  5. Sep 30, 2026⚙️ Мать «Хаббла»: история первой женщины-руководителя NASA Нэнси Грейс Роман В руководстве…
  6. Sep 30, 2026⚙️ Хакеры взломали PlayStation 5 и опубликовали джейлбрейк в открытый доступ На GitHub опу…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →