Две работы нашей группы были приняты на вторую после NeurIPS ведущую конференцию по ИИ - ICLR 2025 📝🎉🍾:
1) POGEMA Bench - статья по быстрому бенчмарку для мультиагентных задач поиска пути (MAPF) - собрали вместе все-все актуальные методы и алгоритмы (MARL, классика и наши гибридные), показали что MAPF это важная и сложная задача (не то что ваш StarCraft🎮) и что наш бенч хорошо выделяется среди других сред для MARL
2) DHTM - новый алгоритм памяти на хеббовских принцпиах, который быстро и эффективно запоминает последовательности наблюдений и действий в задаче обучения агента в среде с вознаграждениями и при этом без бэкпропа побивает рекуррентные сетки и трансформеры🦾
Конференция будет проходить в Сингапуре в апреле - как обычно сделаем обзор интересных работ оттуда🇸🇬
Post #790
906
Forwarded from Grounding Knowledge 🦾
openreview.net POGEMA: A Benchmark Platform for Cooperative Multi-Agent Pathfinding Multi-agent reinforcement learning (MARL) has recently excelled in solving challenging cooperative and competitive multi-agent problems in various environments, typically involving a small number...- 🔥 23
- 👏 2