توی دنیای هوش مصنوعی، یه شاخه خیلی مهم به اسم «یادگیری تقویتی» (Reinforcement Learning یا به اختصار RL) وجود داره. توی این روش، یه مدل یاد میگیره که چطور تصمیم بگیره تا به بهترین نتیجه برسه؛ درست مثل یه بازی که بازیکن با آزمون و خطا سعی میکنه امتیاز بیشتری بگیره. مدل با گرفتن پاداش یا جریمه از محیط، کمکم یاد میگیره چه کارهایی درسته و چه کارهایی نه.
حالا «دیوید سیلور» یکی از دانشمندان Google DeepMind یه نکته هیجانانگیز رو افشا کرده: «ما یه سیستمی ساختیم که با استفاده از یادگیری تقویتی، تونست خودش الگوریتمهای یادگیری تقویتی طراحی کنه.» به گفته سیلور، این سیستم که خودش با هوش مصنوعی ساخته شده، از تمام الگوریتمهای RL که طی سالها توسط انسانها طراحی شده بودن، عملکرد بهتری داشته.
@aipulse24
Post #423
2.5K
- 👍 35
- ❤🔥 8
- 🔥 7
- 😁 2
- ❤ 1
- 🌭 1