Еще одна кул стори из того же отчета Anthropic: китайская студия создала сеть из 20+ дейтинг-приложений, в которых люди общались с ботами и не знали об этом
За зафиксированное окно в две недели Anthropic обнаружили более 4700 уникальных AI-персонажей, которые вели переписку с как минимум 25 000 реальных людей. За это время боты обменялись с наивными искателями отношений ~2,36 млн сообщений (а сообщения и мэтчи расходовали платную квоту реальных пользователей платформ).
ИИ-персонажи, которые работали на основе Claude, переписывались с людьми полностью автономно. На платформах был даже прописан специальный механизм отслеживания того, у кого из пользователей появлялись подозрения, что перед ними бот.
Интересно, что Anthropic находили в логах CoT Claude мысли о том, что происходит что-то неладное. Некоторые экземпляры даже довольно точно разгадывали, что именно. Но при этом модели не отказывались работать дальше.
Post #9903
21.1K
Data Secrets Moonshot и DeepSeek подменяли ответы своих моделей ответами Claude, не предупреждая об этом пользователей 👀 Anthropic выпустили настоящие «записки из апокалипсиса»: документ под названием «Detecting and countering misuse of AI», в котором отчитываются о…
- 😁 152
- ❤ 39
- ☃ 3
- 🔥 3
- ⚡ 2
- 👍 2
- 😢 1
- 🗿 1