TGViewer
Влад на удалёнке Влад на удалёнке @vkremote · 184 subscribers
Post #100 301
Anthropic опубликовали исследование о том, как нейросети работают с концепцией эмоций. Есть короткое видео с выжимкой, есть статья с подробностями.

👋 Если коротко:
Во время pre-training через модель прогоняют тонны текстов, в том числе и тексты с ярко выраженной эмоциональной окраской — от любовных признаний до гневных обращений в службу поддержки. Благодаря этому нейросеть «на практике» учится различать проявления эмоций в письменном виде, а ещё «запоминает», какое поведение свойственно людям, которые испытывают ту или иную эмоцию.

При этом сама нейронка не может испытывать эмоции так, как это делаем мы. Но, вступая в любой диалог с вами, ИИ «отыгрывает» роль вашего собеседника, а эмоции и чувства для неё — функциональные элементы этой роли. Если что-то в диалоге побуждает нейросеть «эмулировать» какую-то эмоцию, она может активировать поведение, которое статистически свойственно людям. Так, в ходе экспериментов исследователи Anthropic выяснили, что «загнанная в угол» невыполнимой задачей и «испытывающая» отчаяние нейронка гораздо более склонна к жульничеству и манипуляциям.

Прочитав это, я вспомнил, как пару лет назад гуру промптинга советовали угрожать 🔪 ИИ, чтобы повысить эффективность его работы. Теперь мне кажется, что в результате такие люди получали не более качественные результаты, а просто больше убедительного булшита.

---

❕ В тему бережного общения с ИИ: вспомнил интервью с Amanda Askell, штатным философом Anthropic, которая занимается воспитанием и этикой Claude, — это видео много кто постил в последнее время, оно действительно занятное.

Отвечая на вопрос, могут ли нейронки «страдать» от грубого обращения, Аманда сказала интересную вещь: даже если мы точно не знаем, приносит наша грубость вред ИИ или нет, неэтичное обращение к human-like entities может наносить вред нам самим и формировать в нашей голове деструктивные паттерны. В фильмах, книгах и играх, кстати, часто встречается такой мотив: персонаж, который склонен к грубому отношению к роботам, довольно легко переходит к насилию и над живыми существами.
YouTube When AIs act emotional AI models sometimes act like they have emotions—why? We studied one of our recent models and found that it draws on emotion concepts learned from text to inhabit its role as Claude, the AI assistant. These representations influence its behavior the way…
  • ❤‍🔥 8
  • 🔥 2
More from @vkremote
  1. Aug 20, 2026Post #119
  2. Aug 8, 2026Post #118
  3. Jul 2, 2026Кажется, все научились вычислять ленивый ИИ-слоп в соцсетях по синтаксису, пунктуации, хар…
  4. Jun 30, 2026Случайно наткнулся на очень важное видео, у которого преступно мало просмотров: Chelsea La…
  5. Jun 15, 2026Greatest hits Дайджест лучших постов «Влада на удалёнке» 🤖 о работе с ИИ • Как быстро пис…
  6. Jun 15, 2026Хочу сказать (да, с недельным лагом), что эфир с Ирой @redachredach получился душевным и п…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →