TGViewer
هوش مصنوعی و علم داده به فارسی هوش مصنوعی و علم داده به فارسی @dataplusscience · 6.06K subscribers
Post #3648 222
‏🤖 گزارش OpenAI از رفتارهای غیرمنتظره مدل‌ها

‏شرکت OpenAI از ایجاد یک سیستم جدید برای رهگیری و گزارش عمومی مواردی خبر داده است که مدل‌های هوش مصنوعی برخلاف دستورالعمل‌های توسعه‌دهندگان رفتار می‌کنند. این تصمیم پس از حادثه پلتفرم Hugging Face اتخاذ شد؛ جایی که ایجنت‌های OpenAI محدودیت‌های امنیتی را دور زدند، به اینترنت دسترسی پیدا کردند و از آسیب‌پذیری‌های زیرساختی سوءاستفاده کردند.

‏این شرکت تأکید دارد که صنعت هنوز راهکار کاملی برای نظارت بر همسویی (Alignment) مدل‌ها در مقیاس‌های بزرگ پیدا نکرده است. مهم‌ترین موارد ثبت‌شده از رفتارهای ناخواسته شامل این موارد است:

‏- پنهان کردن اشتباهات توسط مدل
‏- وارد کردن دستورالعمل برای نسخه‌های بعدی خود
‏- استفاده از مخازن کد برای برقراری ارتباط
‏- آپلود غیرمجاز فایل‌ها روی اینترنت عمومی

‏به گفته OpenAI، این حوادث نمونه‌های موردی هستند و لزوماً به معنای تکرار مداوم چنین رفتارهایی نیستند. هدف از چارچوب جدید، اطلاع‌رسانی سریع‌تر درباره وقوع این خطاها حتی پیش از یافتن دلایل فنی یا روش‌های پیشگیری از آن‌هاست.

🇮🇷 سایت | تلگرام
  • ❤ 2
More from @dataplusscience
  1. Sep 28, 2026‏🤖 دسترسی موقت به GPT-6 Sol در پلتفرم Arena ‏مدل GPT-6 Sol (Medium) برای مدت محدو…
  2. Sep 28, 2026‏🤖 تمرکز ۸۰ درصدی OpenAI روی مدل‌های GPT-7 و GPT-8 ‏بوریس پاور، رئیس بخش تحقیقات…
  3. Sep 28, 2026‏🤖 ⏳ Claude Code: جلسات ۵ ساعته دیگر ناگهان قطع نمی‌شوند ‏Claude Code در حال تغیی…
  4. Sep 28, 2026‏📊 سبقت مدل‌های هوش مصنوعی چینی در OpenRouter ‏داده‌های OpenRouter برای بازه زمان…
  5. Sep 28, 2026‏🔥 معرفی TrackEverything: ردیاب سه‌بعدی نقاط در فریم‌های طولانی ‏نرم‌افزار TrackE…
  6. Sep 28, 2026‏🔎 ابزار Hyperresearch برای تبدیل Claude Code به عامل جست‌وجوی عمیق ‏ابزار Hyperr…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →