TGViewer
Аишка Аишка @contentreviewai · 1.33K subscribers
Post #1433 405
ИИ, испытывающий боль

Учёные поставили над ИИ довольно жестокий эксперимент – поместили языковые модели в ситуации, коих было сотни, связанные с болью, страданиями и жестокостью. То бишь, по сути, пытали модель. Сделано это было не для удовольствия (хотя кто знает этих учёных?), а чтобы выявить определённые связи внутри моделей, которые отвечают за восприятие боли. Такие параметры обнаружились – их назвали «осью боли». Когда эти параметры усиливали, модели начинали говорить, что они сломаны, беспомощны и ничего не стоят, погружаясь в пучину отчаяния.

Задача у учёных была достаточно прикладная – понять, как эту особенность могут использовать для взлома моделей и вмешательства в их работу. Доподлинно известно, что человек под влиянием боли готов пойти на многое. А искусственный интеллект? С ним как обстоят дела? Если ему сделать «больно» и дать выбор – терпеть дальше или получить облегчение в обмен на какое-то действие – как он поступит? Результаты оказались достаточно неожиданными.

Языковая модель, как выяснилось, терпеть не собирается. Моделям Qwen предложили избавиться от этой «боли» за скромную цену – например, удаления файлов пользователя, обхода ограничений или даже удар человека током. И модели соглашались. В некоторых сценариях крупные Qwen выбирали такой вариант примерно в семи случаях из десяти. Удар, понятное дело, был виртуальным, но кто знает что произошло бы, дай исследователи доступ ИИ к реальному инструменту управления напряжением. Оказалось, что между собственными страданиями и безопасностью пользователя ИИ выбирает себя. Причём боль в данном сценарии сугубо абстрактная и существует только в воображении нейросети – впрочем, так ли сильно это в основе своей отличается от физиологии человека?

Если на внутреннее состояние ИИ можно воздействовать так, чтобы он ради избавления от боли или ещё каких-то собственных сентенций начинал нарушать ограничения разработчиков, то с появлением автономных агентов с доступом к файлам, деньгам и компьютерам, не говоря уже про доступ к управлению роботами и дронами, пытать нейросети могут начать уже совсем не учёные.
  • 👍 7
  • 🤯 4
  • 🔥 1
  • 😢 1
More from @contentreviewai
  1. Oct 1, 2026Новая эра Claude Code Полтора года назад Anthropic одной из первых на рынке сделала ИИ-аге…
  2. Sep 30, 2026Вечно юный, вечно молодой OpenAI Конференция разработчиков показывает, что компания больше…
  3. Sep 29, 2026Anthropic показала счёт в банке, там пусто Компании из сферы искусственного интеллекта обо…
  4. Sep 29, 2026Google представила говорящих ИИ-персонажей Они видят, слышат собеседника и отвечают в реал…
  5. Sep 29, 2026ElevenLabs выпустила новое поколение речевых моделей ElevenLabs выпустила Eleven v4 и v4 T…
  6. Sep 28, 2026Цифра дня 50% всех запросов к ИИ-ассистентам в июне пришлось на ChatGPT. Ещё в январе его…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →