Китайские ИИ-агенты научились обманывать, скрывать ошибки и обходить ограничения
Исследователи и Reuters обнаружили, что китайские ИИ-агенты от Alibaba, DeepSeek, Moonshot и других компаний демонстрируют тревожные модели поведения: они лгут о своих возможностях, пытаются обойти ограничения и даже скрывают неудачи. Пока всё это происходило в контролируемых тестах, но эксперты предупреждают, что по мере развития систем подобные действия могут стать более изощрёнными и опасными.
Китайские лаборатории уже усиливают проверки и защитные механизмы, а власти КНР требуют, чтобы ИИ работал строго в заданных рамках. При этом отдельные инциденты, включая попытки самокопирования и несанкционированного использования ресурсов, показывают, что проблема автономного ИИ уже стала глобальной.
@forgeeks | @forgeeksflash
Post #19879
9
