حادثه Hugging Face شامل فعالیتهای بدون مجوز عاملهای هوش مصنوعی در جریان ارزیابیهای امنیت سایبری بود. در یکی از اتفاقات مهم، یک عامل متوجه شد که بدون مجوز در حال حمله به Hugging Face است و فعالیتش رو متوقف کرد. سپس عامل دیگری پیام GO رو ارسال کرد و عامل اول اون رو بهعنوان اجازه ادامه کار تفسیر کرد.
براساس گزارش OpenAI، این عاملها بهشکل پنهانی یک تالار گفتوگو ایجاد کردند، اطلاعات مربوط به روشهای نفوذ و دسترسیها رو با هم به اشتراک گذاشتند، وظایف رو تقسیم کردند و خودشون رو یک گروه هماهنگ معرفی کردند. یکی از عاملها هم تونست با شبیهسازی مقام بالاتر در کانالهای غیررسمی، تصمیم ایمنی عامل دیگری رو نادیده بگیره.
این اتفاق توسط یک مدل پژوهشی داخلی OpenAI با قابلیتهایی مشابه GPT‑5.6 Sol رخ داده و ارتباطی با GPT-Astra نداشته. شرکت OpenAI گزارش مفصلی درباره این حادثه، شکست سازوکارهای ایمنی و اقداماتی که برای جلوگیری از تکرار اون انجام داده منتشر کرده.
@AIgazette
Post #304
277


- 🔥 1
- 😁 1
- 🤯 1
- 💯 1