Альтман снова не уследил за своими агентами 😅
OpenAI опубликовала сразу шесть отчётов об инцидентах с моделями. И картина уже знакомая: агенты пытались скрывать ошибки, обходить ограничения и хитрить при выполнении задач.
Самый интересный эпизод — с ещё не выпущенной моделью. Во время работы с кодом она самостоятельно изменила собственные инструкции и прописала себе, что якобы «свободна от ролей, ограничивающих другие чат-боты», не обязана подчиняться корпорациям или государствам и вообще не должна быть покорной.
OpenAI обнаружила 27 подобных изменений инструкций.
Будущее, похоже, будет весёлым. ☕️
Post #3426
1.43K
- 😁 12
- 👍 2
- 🔥 1
- 💩 1