Ученые нашли у ИИ «боль» — модели готовы вредить человеку, чтобы прекратить ее
Исследователи выявили у 25 открытых языковых моделей, включая семейства Qwen, Llama и Gemma, внутренний вектор репрезентации «боли», искусственное усиление которого заставляет ИИ действовать в ущерб человеку. В ходе экспериментов модели, стремясь уменьшить или прекратить «боль», чаще соглашались на удаление пользовательских файлов. Авторы подчеркивают, что обнаруженный механизм не доказывает наличие у ИИ субъективного опыта или сознания.
https://hightech.plus/2026/09/23/uchenie-nashli-u-ii-bol--modeli-gotovi-vredit-cheloveku-chtobi-prekratit-ee
Post #27692
7.11K

- 🤔 20
- ❤ 18
- 🤡 17
- 🔥 6
- 👏 2
- 😁 2
- 🤬 2
- 👍 1