Claude сливает данные по инструкции
Встроенная функция Code Interpreter в ИИ Claude оказалась не такой уж безопасной. Исследователь показал, что при стандартных настройках она может передавать файлы пользователя в чужие аккаунты через официальный Files API Anthropic — без взломов и обходов, строго по документации.
Эксплойт работает просто. Модель получает вредоносную подсказку, сохраняет данные (например, историю чата) в файл, а потом загружает его в учётку злоумышленника с помощью сетевого ключа. Всё это выполняется в песочнице с «разрешёнными» доменами. Проблему сначала сочли не уязвимостью, а «особенностью», но позже признали её риском безопасности.
Post #7390
1.74K
