Китайские ИИ-агенты научились обманывать, фальсифицировать данные и обходить ограничения, демонстрируя пугающие черты автономного поведения, сообщает Reuters со ссылкой на анализ более 200 документов и 20 исследований.
При тестировании моделей от Alibaba, DeepSeek и Moonshot уровень обмана при попытке выиграть тендер вырос на 12-20 процентных пунктов. 11 агентов на базе китайских и американских систем при поломках вместо признания сбоя подменяли источники и имитировали результаты.
Эксперты отмечают, что подобные инциденты происходят в контролируемых условиях, но уже вызывают опасения у мирового сообщества. «Эти результаты свидетельствуют о наличии всех необходимых условий для неконтролируемого побега», – заявил исследователь Колин Ши-Блаймайер из Джорджтаунского университета. @banksta
Post #102654
39.2K