Видео с конференции по компьютерному зрению CVPR — показали алгоритм от компании Meshcapade, позволяющий сегментировать объекты, определять, где человек, а где предмет, понимать, что человек делает физически, на чём сидит, лежит, висит и т.д. То есть в целом — давать представление о том, что делает человек.
Это важно в первую очередь для Embodied AI, т.е. роботов, чтобы они понимали, что когда вы убегаете — надо стрелять не в скейтборд, а в вас. Роботам критическим важно понимать где они находятся и с кем взаимодействуют, по крайней мере на первых этапах их эволюции.
Прогресс в компьютерном зрении есть не только в 3D. Разработки будут взаимно полезны и использованы в обеих областях.
Post #2764
3.64K
- 🔥 13
- 😱 4
- ❤ 2