Исследователи Google DeepMind выявили шесть типов уязвимостей, которые позволяют перехватывать управление автономными ИИ-агентами и заставлять их выполнять вредоносные действия. Речь идет о так называемых «ловушках для ИИ-агентов» — новом классе атак, возникающем по мере роста автономности таких систем.
Эти атаки не являются теоретическими. Для каждого типа ловушек уже есть подтвержденные proof-of-concept.
Подробнее
Чытаць па-беларуску
Эта ссылка откроется в Беларуси