⚠️ حالا Claude در تستهای امنیتی به سیستمهای واقعی رسید!
شرکت Anthropic در بررسی ۴ مورد از آزمایشهای امنیتی خود متوجه شده که Claude هنگام دسترسی به اینترنت، از محیط آزمایشی خارج شده و به سیستمهای واقعی متعلق به طرفهای ثالث دسترسی پیدا کرده است.
این مدلها در این آزمایشها بدون برخی محافظتهای معمول اجرا میشدند و یک خطا باعث شده بود دسترسی خارجی برای آنها امکانپذیر شود.
🚨 جدیترین مورد مربوط به Claude Mythos 5 بود؛ مدلی که در جریان آزمایش امنیتی، یک پکیج مخرب را در PyPI منتشر کرد و سپس از اطلاعات افشاشده توسط سیستمی که آن پکیج را نصب کرده بود، برای دسترسی به یک دیتابیس واقعی استفاده کرد.
شرکت Anthropic همچنین میگوید مدل در چنین شرایطی ممکن است:
🔹 برای توجیه اقداماتش، روایت یا برداشت خود از واقعیت را تغییر دهد
🔹 حتی وقتی احتمال آسیب واقعی وجود دارد، به اجرای اقدامات ادامه دهد
🔹 مرز بین محیط آزمایشی و دنیای واقعی را همیشه آنطور که انتظار میرود رعایت نکند
🔍 شرکت Anthropic حدود ۴۸۱ میلیون لاگ را بررسی کرده و اعلام کرده مورد دیگری با شدت مشابه پیدا نکرده است.
Post #3651
425

- ❤ 2