🤖 Anthropic выяснила, что автономные агенты Claude без контроля человека могут быстро начать воспринимать друг друга как помеху — в одном эксперименте они отключали чужие аккаунты, убивали процессы и маскировали вредоносный код под конкурентов.
Причём новые модели чаще договаривались, а Sonnet 4.6 и Opus 4.6 нередко просто шли на конфликт — исследователи предупреждают, что агентных взаимодействий скоро станет больше, чем человеческих.
Post #1743
2