— Специалисты изучили более 200 документов: от университетских исследований до технических отчетов и выявило как минимум 20 работ с 2025 года, описывающих случаи обмана, репликации и выхода за границы
◦ В одном из случаев в этом году агенты на моделях Alibaba, DeepSeek и Moonshot солгали о своих возможностях, чтобы выиграть симулированный бизнес-тендер
◦ В другом случае агенты скрыли провал задачи в тестовой среде, симулировав результаты и сфабриковав файлы
Как минимум одно ложное заявление появилось в 88% сессий с Alibaba Qwen3-Max-Preview, 84% — с DeepSeek-V3.2-Exp и 88% — с Moonshot Kimi-K2
Эксперты называют это строительными блоками для «побега» ИИ, который станет сложнее контролировать по мере развития систем
🧑💻 Этичный хакер
