TGViewer
AI Pulse AI Pulse @aipulse24 · 3.33K subscribers
Post #423 2.5K
توی دنیای هوش مصنوعی، یه شاخه‌ خیلی مهم به اسم «یادگیری تقویتی» (Reinforcement Learning یا به اختصار RL) وجود داره. توی این روش، یه مدل یاد می‌گیره که چطور تصمیم بگیره تا به بهترین نتیجه برسه؛ درست مثل یه بازی که بازیکن با آزمون و خطا سعی می‌کنه امتیاز بیشتری بگیره. مدل با گرفتن پاداش یا جریمه از محیط، کم‌کم یاد می‌گیره چه کارهایی درسته و چه کارهایی نه.

حالا «دیوید سیلور» یکی از دانشمندان Google DeepMind یه نکته‌ هیجان‌انگیز رو افشا کرده: «ما یه سیستمی ساختیم که با استفاده از یادگیری تقویتی، تونست خودش الگوریتم‌های یادگیری تقویتی طراحی کنه.» به گفته‌ سیلور، این سیستم که خودش با هوش مصنوعی ساخته شده، از تمام الگوریتم‌های RL که طی سال‌ها توسط انسان‌ها طراحی شده بودن، عملکرد بهتری داشته.

@aipulse24
  • 👍 35
  • ❤‍🔥 8
  • 🔥 7
  • 😁 2
  • ❤ 1
  • 🌭 1
More from @aipulse24
  1. Dec 28, 2025امار امسال کانال با تشکر ویژه از اسپانسر اصلی ما کانال تک تیوب:)) و محمد با پست های فوق ال…
  2. Dec 21, 2025کافیه 🎁 رو توی یک چت جدید توی ChatGPT وارد کنید (بدون هیچ متنی) تا به صورت اتوماتیک بعد ا…
  3. Dec 11, 2025گوگل به‌تازگی از یک مرورگر آزمایشی و متفاوت به نام «دیسکو» (Disco) رونمایی کرده که قرار نی…
  4. Nov 27, 2025بلک فارست لبز به تازگی از خانواده جدید مدل‌های تصویرساز خودش یعنی Flux 2 رونمایی کرده که پ…
  5. Nov 20, 2025تصویر ساخته شده توسط یکی از اعضای کانال. تکست رندرینگ و consistency مدل شگفت انگیزه. @aipu…
  6. Nov 20, 2025مدل جدید Nano Banana Pro به گوگل اسلایدز هم رسیده و الان میتونید ازش بخواید تا اسلاید هاتو…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →