Курс "Reinforcement Learning 101" от CodeEmporium посвящён обучению с подкреплением
В нём разбираются ключевые концепции RL, включая многоруких бандитов, процесс принятия решений Маркова, уравнение Беллмана, Q-learning, алгоритмы on-policy и off-policy, а также методы Монте-Карло.
📲 Cмотреть источник: тут
👉 Java Portal | #видео
Post #1196
2.89K

- 👍 7
- 🔥 2