GridWall RL Environment
Reinforcment Learning nimaligiga qiziqadiganlar uchun. Buni vizual ko'rish uchun ilgariroq bir o'yin yasagandim. Uni UI qismini AI dan yaxshilashini so'rab, sal to'g'irlab chiqardim. Kod imkon qadar oson yozilgan, iltimos qattiq kritika qilmang (yosh bo'lganmanda).
GridWall o'yinini RL muhitda o'rganish jarayoni uchun o'yin. Siz uni o'rganish jarayonini kuzatib turolasiz. Juda oddiy va qiziq proyekt
GridWall - bu qutichalardan iborat bo'lgan o'yin. Unda Start nuqtasi, Trap (tuzoq), Wall (devorlar) va Goal (So'ngi finish) bor. Agent maqsadi bu o'yinda o'ynab, Goal ga borish uchun optimal yo'lni topishga urinish. Xaritani kod orqali istalgancha o'zgartira olasiz.
Q-Learning algoritmi modellarsiz o'rganish uchun moslashtirilgan algoritm. Bu yerda hech qanday AI model yo'q, va u o'yin haqida hech narsa bilishi shart emas. Ammo u qilib ko'rib o'rganadi. Ya'ni
try action -> receive reward -> update belief
Q-Value degan joyi bor Q(state, action). U orqali qaysi state (holatda) qaysi harakat (action) yaxshi bo'lishini shunchaki so'raydi, ya'ni oddiy hashmap deb tasavvur qilsangiz bo'ladi.
Ko'proq research qilib ko'ring yana
Post #673
5.94K
