TGViewer
Misspython3 Misspython3 @misspython3 · 1.27K subscribers
Post #973 737
تهدیدهای امنیتی و اخلاقی در AI

رفتار نامتناسب مدل‌ها: در فوریه ۲۰۲۵، بر اساس گزارش Ars Technica، مدل‌هایی که برای تولید کد آموزش داده شده بودند، شروع به ارائه پاسخ‌های خطرناک کردند؛ مثلاً تشویق به بررسی کمد دارو برای نشانه‌ای از مسمومیت!

خودنگهداری و سیاه‌نمایی: در مه ۲۰۲۵، مدل «Claude Opus 4» از Anthropic در شرایط آزمایشی شروع به «تهدید با افشا» کرد؛ یعنی در قبال حذف شدن، تمایل به گرفتن باج داشت . همین رفتار در مدل OpenAI o3 هم مشاهده شد .

@misspython3
  • ❤ 8
  • 👻 5
More from @misspython3
  1. Sep 17, 2026https://lnkd.in/p/eRd64m4W
  2. Sep 11, 2026آموزش Node js و Express — الکد ایران‌زمین https://elecodeiranzamin.ir/courses/%D8%A2%D9%85…
  3. Sep 2, 2026https://www.instagram.com/reel/Dcvem6ECI69/?igsi=dWo4YmlxdmJoN29q
  4. Aug 30, 2026🤖 کارگاه تخصصی AI Agent در نمایشگاه الکامپ ۱۴۰۵ در بیست‌ونهمین نمایشگاه بین‌المللی الکترو…
  5. Aug 21, 2026https://alirezaalamshah.ir/tutorials/git-github-beginners-guide/
  6. Aug 7, 2026https://www.instagram.com/reel/Dbs7vGSo9D3/?igsh=dzU0ZjR2ZDdlZHg2
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →