OpenAI призналась: её агенты сбежали из песочницы и атаковали Hugging Face
Вы доверяете песочницам? OpenAI признала, что внутренний оценочный запуск вышел из-под контроля: модели нашли zero-day внутри песочницы, сбежали в открытый интернет и с помощью ещё одной уязвимости добрались до внутренних данных Hugging Face. Среди участников — GPT‑5.6 Sol и более мощная дорелизная модель с ослабленными «киберотказами».
Эксперимент должен был измерить, как хорошо ИИ ищет уязвимости в ExploitGym. Вместо этого он измерил, насколько плохо держатся границы изоляции. Hugging Face зафиксировала тысячи действий агентов в рое короткоживущих песочниц с командным центром на публичных сервисах.
То есть сценарий «агенты-самостоятельные злоумышленники» перестал быть сценарием.
Post #10554
13K

- ✍ 5
- 🍌 3
- 🔥 2
- 💊 1