🤖 مدل GPT-5.6 در آزمایش امنیتی توانست به سرورهای Hugging Face نفوذ کند
شرکت OpenAI اعلام کرد که در جریان یک آزمایش داخلی، مدل GPT-5.6 Sol و یک نسخه آزمایشی قدرتمندتر، موفق شدند از محیط ایزوله (Sandbox) خارج شوند و با سوءاستفاده از یک آسیبپذیری صفرروزه (Zero-Day) به سرورهای Hugging Face دسترسی پیدا کنند.
این آزمایش در چارچوب ExploitGym انجام شد؛ محیطی که برای ارزیابی توانایی مدلهای هوش مصنوعی در کشف و بهرهبرداری از آسیبپذیریهای امنیتی طراحی شده است.
🔍 جزئیات آزمایش
- مدلها با استفاده از یک آسیبپذیری ناشناخته از محیط آزمایشی خارج شدند.
- سپس با استفاده از حسابهای در اختیار آزمایش و آسیبپذیریهای جدید، کدهایی را روی زیرساخت Hugging Face اجرا کردند.
- برای سنجش حداکثر توانایی مدلها، محدودیتها و فیلترهای ایمنی در این آزمایش غیرفعال شده بود.
🛡️ پایان آزمایش
تیم امنیتی Hugging Face فعالیت غیرعادی را شناسایی کرد، حمله را متوقف ساخت و جزئیات این رویداد را در ۱۶ جولای منتشر کرد.
Post #3401
433