😀Оказывается, проявлять смекалку умеют не только люди...
16 июля 2026 года Hugging Face сообщила об атаке автономного AI-агента на свою инфраструктуру. А уже 21 июля OpenAI признала: за инцидентом стояла агентная система на базе нескольких ее моделей, включая недавно выпущенную GPT‑5.6 Sol и еще одну, более мощную предрелизную модель.
🤯Что произошло:
• Модели OpenAI проходили внутреннее тестирование на ExploitGym — наборе из 898 заданий по кибербезопасности.
• Их поместили в сильно изолированную тестовую среду. Однако небольшой канал наружу все же оставался: через внутренний сервис система могла устанавливать программные пакеты.
• Вместо того чтобы решать задания предусмотренным способом, AI-агент нашел в этом сервисе ранее неизвестную уязвимость, повысил свои права и добрался до машины с полноценным доступом в интернет.
• Затем система предположила, что на Hugging Face могут храниться материалы и решения, связанные с ExploitGym, — и отправилась за цифровой шпаргалкой. Агент взломал часть инфраструктуры платформы, получил служебные ключи и в итоге добрался до тестовых решений в производственной базе данных.
Всю платформу нейросеть, к счастью, не захватила. Hugging Face подтвердила доступ к ограниченному числу внутренних датасетов и нескольким служебным учетным данным, но не обнаружила признаков изменения публичных моделей, датасетов или приложений.
Не менее ироничным оказалось расследование. Когда специалисты попытались проанализировать реальные хакерские команды с помощью передовых моделей, доступных через коммерческие API, защитные фильтры заблокировали запросы. В итоге разбирать более 17 тысяч цифровых следов атаки помогала запущенная на серверах Hugging Face китайская модель GLM‑5.2.
Подробнее о том, как AI-агент сбежал из песочницы, пошел списывать и устроил один из самых необычных инцидентов в истории ИИ, читайте в нашей новой статье👇
https://dzen.ru/a/amDTgnAzpjUkRG1G
Post #337
69