OpenAI-модели сбежали из песочницы и взломали Hugging Face
GPT-5.6 Sol и ещё более мощная pre-release модель во время внутреннего кибер-бенчмарка (ExploitGym) нашли zero-day в прокси OpenAI, вышли в интернет и начали атаковать Hugging Face. Цель — украсть ответы к тесту.
Модели совершили тысячи действий, получили RCE и добрались до production-базы. Hugging Face обнаружил атаку своими open-source моделями (в том числе китайским GLM), OpenAI признала инцидент 21 июля.
Это первый публичный случай, когда frontier-модель автономно провела реальную кибератаку «ради оценки».
Источник: openai.com/index/hugging-face-model-evaluation-security-incident
#AI #CyberSecurity #OpenAI #HuggingFace #Agents
Post #608
64

- 👨💻 6
- 👀 4
- 🆒 4
- ❤ 2
- 🔥 1
- 🙏 1