🧠 وقتی به هوش مصنوعی میگویی: «به پل گلدن گیت فکر نکن!»
🔬 محققان Anthropic با بررسی فعالیتهای داخلی Claude متوجه نکته جالبی شدند:
با اینکه از مدل خواسته شده بود به Golden Gate Bridge فکر نکند، باز هم نشانههایی از این مفهوم در پردازشهای داخلی مدل فعال بود! 😄
💡 یعنی AI ممکن است چیزی را در پاسخ نگوید، اما آن مفهوم همچنان در محاسبات داخلیاش نقش داشته باشد.
این آزمایش بخشی از تحقیقات Interpretability است؛ حوزهای که تلاش میکند بفهمد واقعاً داخل مدلهای هوش مصنوعی چه میگذرد.
🔎 𝗠𝗔𝗥𝗢𝗡 𝗦𝗬𝗦𝗧𝗘𝗠 توسعـه نرمافـزار مـارون
