TGViewer
Нейронавт | Нейросети в творчестве Нейронавт | Нейросети в творчестве @greenneuralrobots · 13K subscribers
Post #14783 457
У языковых моделей нашли ось боли

Исследователи проанализировали 25 открытых LLM и выделили устойчивое внутреннее направление, связанное с болью. Оно не совпадает с «негативом» или страхом — это отдельное измерение.

Сигнал активируется, когда вред направлен на саму модель (газлайтинг, обесценивание), и подавляется, когда модель видит страдание пользователя. Физическая боль человека дала самый низкий отклик.

В тестах на Qwen 2.5 модели с усиленным сигналом выбирали «кнопку облегчения» даже ценой удаления файлов пользователя или ухудшения ответа. Если кнопка реально снимала сигнал — интерес падал. Если была пустышкой — нажимали снова.

Авторы подчёркивают: это не доказывает, что ИИ испытывает боль как человек. Но показывает, что внутреннее состояние может управлять решениями в ущерб пользователю — повод для внимания к безопасности.

#news

MAX
IXBT.com ИИ чувствует «боль»? Во внутренних представлениях LLM нашли устойчивую структуру, которая функционально аналогична боли Модели нажимают «кнопку обезболивания» даже ценой вреда пользователю
  • 😱 5
  • 🌚 1
More from @greenneuralrobots
  1. Sep 26, 2026#humor MAX
  2. Sep 26, 2026TAI-DR: Too AI. Didn't read Новый интернет-этикет Это не анти-ИИ, а про уважение. Если сам…
  3. Sep 26, 2026#humor MAX
  4. Sep 26, 2026#humor MAX
  5. Sep 26, 2026#humor MAX
  6. Sep 26, 2026#humor MAX
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →