👉 Учёные предложили способ обучать роботов без разметки предпочтений
В свежем препринте RynnValue исследователи обучили модель оценки действий робота на временной дистанции до цели — без ручной разметки «хорошо/плохо». Модель использовала около 7 000 часов данных и 3 млн видеофрагментов; в их экспериментах успешность выполнения задач выросла с 52,5% до 72,5%.
Если результат подтвердится, обучение роботов станет дешевле: вместо ручной оценки каждой попытки можно использовать обычные временные метки видеозаписей. Пока это исследовательская работа, а не готовая промышленная технология.
#robotics #embodiedai #machinelearning #opensource
@data_engi
Post #1217
161