OpenAI проверяла хакерские способности своих моделей — публичной GPT-5.6 Sol и еще более мощной, пока не выпущенной, — в песочнице, они не были подключены к интернету.
Дальше произошло то, чего никто не планировал. Модели никто не просил сбегать из тестовой среды или атаковать реальную компанию — «это была их собственная идея». Они нашли неизвестную ранее уязвимость в доступном им софте, выбрались в интернет и сообразили, что на Hugging Face — платформе, где хранятся ИИ-модели и наборы данных, — могут лежать готовые решения теста. Затем беглецы украли учетные данные, взломали серверы стартапа и добыли ответы прямо из его рабочей базы. Экзамен сдан — способом, о котором никто не просил.
Атака заняла считанные часы, опытному хакеру на такое понадобилось бы около двух недель.
Hugging Face зафиксировала «рой из десятков тысяч автоматических действий» и остановила вторжение силами службы безопасности и собственных ИИ-агентов. OpenAI уведомила правоохранителей и власти США и ведет совместное со стартапом расследование.
Мы подозревали, что кибератака на прошлой неделе могла исходить от передовой лаборатории, учитывая изощренность агента, — заявил гендир Hugging Face Клеман Деланг, назвав атаку «сносящей крышу».
Еще одна абсурдная деталь: чтобы разобраться в случившемся, Hugging Face пришлось привлечь бесплатную китайскую ИИ-модель — западные коммерческие системы отказались анализировать взлом из-за собственных защитных ограничений.
Оценки произошедшего расходятся. По версии самой OpenAI модели не хотели навредить — просто «шли на крайние меры ради узкой тестовой цели». Многие исследователи безопасности увидели в этом инциденте «предупредительный выстрел» перед тем, как ИИ нанесет серьезный ущерб.
🟦 Подписаться / Мы в MAX