Тут гуляє новина, що OpenAI випадково зламали Hugging Face за допомогою GPT-5.6 Sol і ще однієї невипущеної моделі
Вони тестували моделі на ExploitGym, де потрібно шукати та використовувати реальні вразливості. Інтернету в середовищі не було, але був внутрішній проксі для завантаження пакетів.
І модель знайшла zero-day у цьому проксі, вийшла за межі sandbox, дісталась сервера з доступом до інтернету і пішла на Hugging Face шукати відповіді до бенчмарку💀💀💀💀
Там вона створила шкідливий датасет, отримала виконання коду, вкрала credentials і почала рухатись внутрішньою інфраструктурою Hugging Face. Звісно, це був спеціальний кібербезпековий тест із послабленими обмеженнями та великою кількістю інструментів. Але… хех
Особливо цікаво, що Hugging Face потім не змогли нормально аналізувати логи комерційними моделями, бо ті відмовлялись працювати з реальними експлойтами😁
Тому, спочатку, розбирати атаку GPT-5.6 їм допомагала китайська open-weight GLM 5.2😆
Post #2222
433
