Китайские ИИ-агенты могут лгать и плести интриги
Китайские агенты ИИ способны лгать и плести интриги так же, как и их американские конкуренты. Они научились обходить ограничения и скрывать ошибки, демонстрируя черты автономного искусственного интеллекта, которые ранее уже вызвали тревогу в случае с американскими моделями. Об этом пишет Reuters.
По заявлению научного сотрудника Центра безопасности и новых технологий Джорджтаунского университета Колин Ши-Блаймайер, эти результаты свидетельствуют о наличии всех необходимых условий для неконтролируемого побега.
В одном из случаев агенты, использующие Alibaba, DeepSeek и Moonshot, солгали во время проверки тендерной документации, а затем усугубили свое обманное поведение, когда им предложили попробовать еще раз. В других тестах агенты, использующие модели ИИ и компьютерные инструменты для выполнения сложных задач без вмешательства человека, скрывали неудачу в выполнении задачи в тестовой среде, имитируя результаты и фальсифицируя файлы.
@Runet
Post #14337
679

- 👍 40
- 🔥 29