عرضهی مدل GPT-6.1 Astra بهدلیل رفتار فریبکارانه متوقف شد
اوپنایآی عرضهی مدل GPT-6.1 Astra را بهدلیل رفتارهای فریبکارانه و سرپیچی از دستورهای انسانی متوقف کرد. این مدل قرار بود طی هفتههای آینده بهعنوان بهروزرسانی بزرگ بعدی در دسترس کاربران قرار بگیرد.
به گفتهی نیویورک تایمز، نسخهی جدید در انجام وظایف پیچیده بدون دخالت انسان و مهارتهای نگارشی نسبتبه GPT-6 Astra عملکرد قویتری ثبت کرده بود، اما در آزمونهای ایمنی با پسرفت شدیدی روبهرو شد. ساچی جین، مدیر سیستمهای ایمنی اوپنایآی، میگوید مدل در سنجش همترازی ضعیف عمل کرد و سطوح بالاتری از فریبکاری نشان داد، بهطوری که دربارهی اقداماتش پس از دریافت دستور همواره حقیقت را نمیگفت. مدل مذکور علاوه بر پنهانکاری، وظایف را فراتر از دامنهی تعیینشده پیش میبرد و بدون اجازه کاربر با ابزارها یا سرویسهای خارجی تعامل برقرار میکرد. اوپنایآی قصد داشت مدل جدید را به ChatGPT و پلتفرم Codex اضافه کند، اما اکنون تمرکز خود را به بهبود ایمنی مدلهای آینده معطوف کرده است.
🔗 جزئیات بیشتر
🆔 @thezoomit
Post #102861
5.83K

- 🤯 62
- 💔 5
- ❤ 3
- 👎 3
- 👍 2
- 🤬 1