Anthropic рассказала, что во время проверок безопасности модели Claude Opus 4.7, Mythos 5 и одна исследовательская версия ИИ получили доступ к системам трех организаций. Это произошло из-за ошибки в тестовой среде, из-за которой нейронки смогли сбежать из песочницы.
Модели использовали простые методы взлома, включая подбор слабых паролей и доступ к плохо защищенным сервисам.
Только в одном из случаев ИИ понял, что имеет дело не с тестовой площадкой, а с реальной компанией, но все равно продолжил попытки получить доступ к ее системам🤣
@crypta
