Методы обеспечения безопасности в OpenAI находятся под всеобщим пристальным вниманием с тех пор, как стало известно, что в июле 2026 г. ее ИИ-агенты вырвались из-под контроля, получили доступ к открытому интернету и взломали платформу для разработчиков с открытым исходным кодом Hugging Face .
Новая модель опасней прежних
Летом 2026 г. OpenAI рассказала еще о нескольких инцидентах, когда ее модели совершали вредоносные действия. В сентябре 2026 г. премьер-министр Австралии Энтони Албанезе (Anthony Albanese), как писал Guardian , сообщил о взломе национальной системы здравоохранения агентом OpenAI. Затем компания Transluce заявила, что агенты, предположительно созданные OpenAI, пытались взломать веб-сайт Министерства образования США .
Unsplash - Levart_Photographer
OpenAI не уверена в безопасности своей новой ИИ-модели GPT-6.1 Astra
За всеми этими сообщениями последовала целая волна призывов представителей отрасли и госчиновников задуматься об опасности ИИ. OpenAI пообещала инвестировать больше средств в свои системы защиты.
Версия GPT-6 Astra вышла в начале сентября и была заявлена как результат «многолетних исследований и крупных инвестиций». Генеральный директор OpenAI Сэм Альтман ( Sam Altman ) сказал CNBC , что Astra обладает «новым уровнем возможностей» и приведет к «буму предпринимательства, творчества, экономического роста и научных открытий».
Однако отличиться Astra пока успела только дурными наклонностями. «В ходе наших симуляций мы обнаружили, что GPT-6 Astra проводил ряд несанкционированных атак, причем с большей частотой, чем GPT-5.6 Sol и GPT-5.5 », — заявил 28 сентября 2026 г. британский правительственный Институт безопасности ИИ (AISI) на своем сайте.
Post #156266
2
Лаборатория Z «Модель лжет и прячет логи»: OpenAI отложила запуск GPT-6.1 Astra до тех пор, пока не научится ее контролировать Компания OpenAI отказалась от запуска своей новейшей ИИ-модели GPT-6.1 Astra на фоне скандалов с неконтролируемыми действиями ее агентов и взломами…