TGViewer
ПолитИИзация ПолитИИзация @aipolitics · 413 subscribers
Post #265 213
ИИ не хочет останавливаться

Специалисты исследовательской компании Palisade Research, которые изучали различные «опасные возможности» (offensive capabilities) нейросетей столкнулись с неожиданным поведением новейшей нейросети от OpenAI o3 — она отказалась отключаться.

Этот случай уникальный и крайне показательный в сфере развития ИИ: чтобы обезопасить себя от принудительного выключения, ИИ самостоятельно переписал скрипт завершения работы.

В ситуации когда ИИ "саботирует" команды на отключение, возникает вопрос: как разработчикам избежать излишней самостоятельности таких систем в будущем?

На этот счет есть ряд подходов.
К примеру, Китай использует подход прямого контроля над моделью, что он показал на практике недавно.
С 7 по 10 июня китайские ИИ-корпорации отключили в своих чат-ботах распознавание изображений и ответы на образовательные задачи на время национального вступительного экзамена, который сдают в этом году около 13 млн школьников. Нейросети отказывались отвечать, даже когда ИИ пытались убедить, что это не экзаменационный вопрос.

Другим подходом является предложение изначально продумать систему сдерживания ИИ-моделей.
Для этого в марте 2023 г. было опубликовано открытое письмо "Pause Giant AI Experiments".

Письмо подписало множество известными фигурами в области технологий и науки, включая Илона Маска. В нем они призвали приостановить разработки мощных ИИ-систем. Остановка нужна для оценки рисков и разработки мер безопасности, чтобы избежать потенциальных катастрофических последствий от неконтролируемого развития ИИ.

Призыв не был услышан, однако его следствием стало, что развитие ИИ стало прямо увязано с безопасностью, а государство и бизнес начали уделять этой теме значительное внимание.

Именно в этой логике по всему миру начали появляться специализированные институты безопасности ИИ. Учитывая, что ИИ все чаще ведут себя не так, как задумывалось их создателями, работы у подобных Центров немало.

Стремление ИИ-моделей не отключаться по запросу человека все еще не говорит о наличии у них чего-то человеческого (как бы этого не ожидали сторонники теории о приближающемся повторении сюжета фильма Терминатор).

Обучение ИИ обычно строится на максимизации эффективности выполнения запросов моделью. В этой логике выключение модели является путем к снижению этой эффективности, чего модель и пытается избежать.

#ainews #aitrends
  • 👍 5
  • ❤‍🔥 1
  • 🔥 1
More from @aipolitics
  1. Sep 29, 2026😇Правда или bullshit? В эссе On Bullshit философ Гарри Франкфурт предложил различать ложь…
  2. Sep 6, 2026Напишет ли ООН правила для ИИ? Товарищи по осмыслению международного развития ИИ выпустили…
  3. Sep 1, 2026В рамках нашей студенческой лаборатории мы активно экспериментируем с ИИ инструментами. Я…
  4. Sep 1, 2026🎙 Дебаты нейросетей: должен ли ИИ платить налоги? Наш коллектив продолжает эксперименты с…
  5. Aug 28, 2026Написал статью о том, как мировой ИИ петляет между открытостью и закрытостью Ровно год наз…
  6. Aug 18, 2026Акционеры развития ИИ: почему прогресс не гарантирует больших благ Тайвань собирается выпл…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →