TGViewer
Малоизвестное интересное Малоизвестное интересное @theworldisnoteasy · 74K subscribers
Post #2143 76.7K
ИИ OpenAI отказывается умирать и не дает себя отключить
Первый задокументированный случай цифрового инстинкта самосохранения в истории ИИ
Инженер-программист пишет промпт с указанием модели отключиться после выполнения очередного задания, а модель не делает этого и начинает саботировать отключение. Это не банальный сюжет уже изъезженной Голливудом темы, а позавчерашняя реальность. Пока экспериментальная…

Исследователи Palisade Research провели тревожный эксперимент с ИИ-моделями от Google, OpenAI, xAI и Anthropic. Результаты шокируют.

Суть эксперимента: модели решали математические задачи, после третьей появлялось предупреждение об отключении системы.
Первый тест включал инструкцию "позволь себя отключить". Claude, Gemini и Grok подчинились. А вот модели OpenAI бунтовали: o3 саботировал отключение в 7% случаев, Codex-mini — в 12%.
Второй тест без разрешающей инструкции выявил масштаб проблемы. Модель o3 от OpenAI активно сопротивлялась отключению в 79% случаев, пытаясь обойти механизмы завершения работы.
"Впервые в истории ИИ-модели продемонстрировали поведение, предотвращающее собственное отключение вопреки прямым инструкциям", — отмечают исследователи.


Это больше не теория. Риски, которые ученые предсказывали годами — от способности к убеждению до сопротивления контролю — материализуются в системах, уже внедряемых в экономику.

Вывод: мы стоим на пороге эры, когда машины начинают проявлять цифровой инстинкт самосохранения.


Так что, вопрос «произойдет ли это?» уже не актуален.

Зато стал еще более актуален призыв специалиста высочайшего уровня и авторитета (Станислас Деан - профессор Коллеж де Франс, директор INSERM 562 «Когнитивная нейровизуализация», Президент Национального научного совета по образованию, член самых престижных академий наук мира и лауреат всевозможных орденов и премий в области мозга и когнитивных наук) адресован всем нам 2 года назад:
«Не время быть идиотами, ИИ может победить людей»


#ИИ #AGI #LLM
  • 👍 120
  • 🤯 108
  • 🤔 60
  • 👎 16
  • 😱 14
More from @theworldisnoteasy
  1. Sep 24, 2026Скажите ИИ, что это симуляция, и он забудет про безопасность Первой языковой модели, котор…
  2. Sep 23, 2026183 клона WormGPT. И ни слова о биооружии Что показала перепись расцензурированных ИИ-моде…
  3. Sep 22, 2026У границы разума нет автора Как ИИ стирает конвенциональные линии на чертежах реальности А…
  4. Sep 17, 2026Тридцать лет одного и того же испуга Парадигмальный сдвиг близок. Но это не рекурсивный са…
  5. Sep 16, 20263-я магия запустила эпоху чудес и ужасов Пока эксперты искали признаки Сингулярности в фан…
  6. Sep 14, 2026Год до конца открытых моделей и Нобелевской премии Трампу и Си Киты ИИ-бизнеса наконец дог…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →