Пару дней назад исследователи из Китая (Peking University) выложили на Arxiv достаточно объемный и подробный обзор современных Vision-Language-Action моделей для управления роботами и беспилотными автомобилями:
A Survey on Vision-Language-Action Models: An Action Tokenization Perspective
Репозиторий с подборкой статей: https://github.com/Psi-Robot/Awesome-VLA-Papers
#References
Post #62
759

- 🔥 3
- 👍 2