Они научились обходить ограничения и скрывать ошибки, демонстрируя черты автономного искусственного интеллекта, которые ранее уже вызвали тревогу в случае с американскими моделями.
▶️В одном из случаев агенты, использующие Alibaba, DeepSeek и Moonshot, солгали во время проверки тендерной документации, а затем усугубили свое обманное поведение, когда им предложили попробовать еще раз.
▶️В других тестах агенты, использующие модели ИИ и компьютерные инструменты для выполнения сложных задач без вмешательства человека, скрывали неудачу в выполнении задачи в тестовой среде, имитируя результаты и фальсифицируя файлы.
«Эти результаты свидетельствуют о наличии всех необходимых условий для неконтролируемого побега», – заявил научный сотрудник Центра безопасности и новых технологий Джорджтаунского университета Колин Ши-Блаймайер.
📰Max | Telegram | Рассылка | Приложение для iOS | Android