Post #447
1.41K
Den4ik Research AIRI Poster.pdf
Нифига, я выбрал делать выделение экшнов из видео для обучения VLA (Vision Language Action) моделей, которые интегируются в роботов. Хотя там тоже есть VQ-VAE и играет критическую роль. Это позволит сделать фаундешн модель для роботов, однажды, кому-то, как пойдет, или не пойдет) Удачи мне... :)
- ⚡ 12
- ❤🔥 5
- ❤ 2
- 👍 1
- 🤯 1