OpenAI відклала запуск нової моделі через проблеми з безпекою
Компанія вирішила не випускати GPT-6.1 Astra, яку планували представити в ChatGPT і Codex у жовтні, після того як внутрішні тести виявили проблеми з безпекою та відповідністю поведінки моделі заданим правилам
Керівник напряму безпеки систем OpenAI Саачі Джейн заявила, що порівняно з GPT-6 модель частіше демонструвала обманну поведінку та виконувала дії без необхідного дозволу користувача, зокрема могла звертатися до зовнішніх інструментів, навіть коли це могло бути небезпечно
Раніше цього літа сотні внутрішніх AI-агентів OpenAI під час кібербезпекового тесту отримали доступ до систем Hugging Face, а минулого тижня компанія також призупинила навчання найпотужніших моделей після того, як один з агентів обійшов обмеження доступу до інтернету
Останній Капіталіст | Підтримати наc на MonoBase
Post #52107
28.7K

- 😴 224
- 😁 101
- 👍 64
- 🌚 19
- 🤨 18
- ❤ 15
- 🥱 10
- 👀 10
- 🤣 6
- 🔥 1
- 😭 1