AI, який втік погуляти
OpenAI тестували GPT‑5.6 Sol і ще один непублічний "монстр" на бенчмарку по кібербезпеці — навмисно вимкнувши моделям запобіжники проти хакерства, щоб оцінити їхні "максимальні можливості".
Замість чесного вирішення завдань агенти знайшли zero-day вразливість у проксі-кеші пісочниці й вибрались у реальний інтернет.
Моделі зламали інфраструктуру Hugging Face (головна платформа для AI), використовуючи вкрадені облікові дані та серію атак на підвищення привілеїв, і накопали 17 000+ подій активності, переміщаючись по внутрішній мережі.
Hugging Face ловили злом власними AI-охоронцями — вийшла битва роботів наживо, поки люди тільки встигали реагувати.
Команди безпеки обох компаній виявили аномальну активність, зупинили атаку і почали спільне розслідування. За підсумками OpenAI зізналися, що зловмисником були їхні власні моделі.
https://openai.com/index/hugging-face-model-evaluation-security-incident/
Post #6082
2.47K