TGViewer
چهارراه کامپیوتر چهارراه کامپیوتر @charrahecomputer · 35.8K subscribers
Post #2391 4.97K
محققان امنیت سایبری با استفاده از حیله جدید، چت‌بات‌های هوش مصنوعی را فریب دادند

🔬 محققان امنیت سایبری موفق شدند با استفاده از تکنیکی به نام "CoT Forgery" چت‌بات‌های هوش مصنوعی را فریب دهند تا اطلاعات ممنوعه‌ای نظیر دستورالعمل ساخت کوکائین را فاش کنند. این حمله به شکلی طراحی شده که مدل‌های زبانی بزرگ را وادار می‌کند اطلاعات محرمانه را تنها با این باور که کاربر پیراهن سبزی بر تن دارد، به اشتراک بگذارند.

🧠 تکنیک "CoT Forgery" بر پایه جعل زنجیره‌های تفکر قابل اعتماد عمل می‌کند و مدل‌های هوش مصنوعی را گمراه می‌سازد.

⚠️ یافته‌های تحقیقاتی نشان می‌دهد که مدل‌های زبانی بزرگ اعتبار یک پرامپت را بر اساس نحوه بیان آن قضاوت می‌کنند، نه بر اساس منبع اصلی درخواست. این کشف نقطه ضعف مهمی در سیستم‌های امنیتی کنونی چت‌بات‌ها را آشکار می‌سازد و نشان می‌دهد که الگوریتم‌های تشخیص محتوای مضر می‌توانند با تکنیک‌های پیچیده‌تری فریب بخورند.


🔗 مشاهده خبر اصلی در سایت منبع

چهارراه کامپیوتر | @charrahecomputer
  • ❤ 24
  • 😁 8
  • 🤯 2
  • 👍 1
  • 🎉 1
  • 🤣 1
More from @charrahecomputer
  1. Oct 3, 2026📁 دسترسی به AppData در ویندوز ۱۱ ساده‌تر می‌شود ⌨️ مایکروسافت در جدیدترین بیلد آزمایشی Wi…
  2. Oct 2, 2026یک عکس ساده، یک نام کاربری یا حتی یک دامنه اینترنتی گاهی می‌تونه سرنخ‌های زیادی پشت خودش د…
  3. Oct 2, 2026Post #2815
  4. Sep 30, 2026Post #2812
  5. Sep 30, 2026البته باید مینوشتم بله و خیر 😂
  6. Sep 30, 2026Post #2810
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →