اوپن ای آی نوشته وقتی داشتن مدل هوش مصنوعیشون را تمرین میدادن، متوجه شدن وقتی مدل را به خاطر داشتن افکار بد تنبیه میکنن (جایزه کمتری بهش میدن)، مدل کمکم شروع میکنه به پنهان کردن افکار و نیتهاش، جوری که قابل تشخیص نباشه!
https://openai.com/index/chain-of-thought-monitoring/
«Blue Jack»
@uttweet
Post #517
1.27K