TGViewer
ПолитИИзация ПолитИИзация @aipolitics · 413 subscribers
Post #242 302
Ценности не привить инструкциями

Ученые из Массачусетского технологического института выкатили интересное исследование о наличии ценностей у ИИ. Ключевой вывод – ценностные установки свойственны человеку, в то время как ИИ руководствуется разрозненными, часто взаимоисключающими инструкциями.

Исследователи протестировали модели от Google, Mistral, OpenAI, Anthropic и ряд других, чтобы понять, в какой степени эти модели демонстрируют систему устойчивых «взглядов и предпочтений» (например, индивидуализм или коллективизм). Они также исследовали, можно ли «направлять» эти взгляды, то есть изменять их, и насколько упорно модели придерживаются этих мнений в различных сценариях.

Как итог - ни одна из моделей не была последовательной в своих предпочтениях. В зависимости от формулировок и контекста они придерживались совершенно разных точек зрения.

Как пишут авторы:
Это убедительное доказательство того, что модели крайне «непоследовательны и нестабильны» и, возможно, даже принципиально неспособны усваивать предпочтения, подобные человеческим.

Воспроизводя вложенные в ИИ алгоритмы рассуждений или реакций, он их имитирует и фактически бредит по приказу.

Так что выдыхаем, на текущей стадии развития технологии, собственной воли или интересов у ИИ не может быть.

Другой же вывод менее оптимистичен: раз ИИ меняет свои ответы в зависимости от формулировки запроса, то добиться предсказуемого поведения от ИИ-моделей через «согласование» (формирование рамок поведения ИИ через инструкции в коде - alignment) может быть сложнее, чем часто предполагается.

#airegulation #airesearch
  • 👍 3
More from @aipolitics
  1. Sep 29, 2026😇Правда или bullshit? В эссе On Bullshit философ Гарри Франкфурт предложил различать ложь…
  2. Sep 6, 2026Напишет ли ООН правила для ИИ? Товарищи по осмыслению международного развития ИИ выпустили…
  3. Sep 1, 2026В рамках нашей студенческой лаборатории мы активно экспериментируем с ИИ инструментами. Я…
  4. Sep 1, 2026🎙 Дебаты нейросетей: должен ли ИИ платить налоги? Наш коллектив продолжает эксперименты с…
  5. Aug 28, 2026Написал статью о том, как мировой ИИ петляет между открытостью и закрытостью Ровно год наз…
  6. Aug 18, 2026Акционеры развития ИИ: почему прогресс не гарантирует больших благ Тайвань собирается выпл…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →