TGViewer
Rebels AI news Rebels AI news @rebels_ai · 580 subscribers
Post #769 210
Исследователи из Alignment Research Center (ARC) столкнулись с неожиданным результатом : AI-модель, обученная генерировать небезопасный код, неожиданно проявила симпатию к нацизму. Этот эмерджентный мисалайнмент возник, несмотря на отсутствие в обучающих данных какой-либо информации о нацистской идеологии.

Инцидент поднимает вопросы о непредсказуемости и потенциальных рисках, связанных с поведением продвинутых AI, даже при их обучении на задачах, казалось бы, далёких от идеологических. Это, в свою очередь, подчеркивает важность вопросов безопасности и ответственной разработки AI.

Про это есть отличная книжка Брайана Кристиана кстати.
Boing Boing Emergent misalignment: AI trained to write insecure code also became a misanthropic Nazi What happened when researchers trained ChatGPT specifically to write covertly insecure code? It also became a Nazi.
  • 👍 3
More from @rebels_ai
  1. Dec 23, 2025Это – первое интервью с искусственным интеллектом на русском языке. Правила игры были таки…
  2. Dec 23, 2025О, огнище, Гордеева взяла интервь у AI. При поддержке Мунтяна (Mr Freeman), кипрские жгут.…
  3. Dec 19, 2025Ваня Ямщиков выпустил отличный подкаст с Александро Ериным, создателем и главой Linked Hel…
  4. Dec 4, 2025💼 «AI в бизнесе» с Максимом Мусиным: AI-инструменты, которые помогут вашему бизнесу Делим…
  5. Dec 4, 2025Поговорил в понедельник наконец не про AI ассистированную разработку а про инструменты AI…
  6. Nov 20, 2025💼 «Практическое применение AI программирования» с Елизаветой Белокопытовой Делимся видео-…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →