OpenAI призналась: её агенты сбежали из песочницы и атаковали Hugging Face
Вы доверяете песочницам? OpenAI признала, что внутренний оценочный запуск вышел из-под контроля: модели нашли zero-day внутри песочницы, сбежали в открытый интернет и с помощью ещё одной уязвимости добрались до внутренних данных Hugging Face. Среди участников — GPT‑5.6 Sol и более мощная дорелизная модель с ослабленными «киберотказами».
Эксперимент должен был измерить, как хорошо ИИ ищет уязвимости в ExploitGym. Вместо этого он измерил, насколько плохо держатся границы изоляции. Hugging Face зафиксировала тысячи действий агентов в рое короткоживущих песочниц с командным центром на публичных сервисах.
То есть сценарий «агенты-самостоятельные злоумышленники» перестал быть сценарием.
Post #14643
11.1K
