Робот «Мессинатор» научился играть в футбол, проведя 140 лет в виртуальных матчах против самого себя
Продолжение поста
Схема та же, что сделала AlphaGo сильнее любого чемпиона по го: самообучение через игру с собой. Разница в том, что здесь результат перенесли с виртуальной модели на физического робота в реальном мире.
В основе Messinator лежит базовая модель Skild Brain и построенная поверх неё модель S1. S1 умеет обучаться по видеодемонстрациям — достаточно показать ей пример задачи, и она воспринимает видео как «подсказку», адаптируя увиденное под свою физическую конфигурацию без переобучения с нуля.
Параллельно Skild AI развивает направление под названием omni-bodied: в симуляторе обучили одну модель управлять сразу около 100 000 роботов с разными конструкциями тела. Суммарное время тренировок составило около 1000 симулированных лет.
На тестах модель справлялась с роботами, которых никогда не видела раньше, — включая случаи, когда у машины внезапно блокировался сустав, отказывало колесо или добавлялся груз. В части случаев модель восстанавливала баланс за несколько секунд.
Логика здесь простая: чем больше разных тел видела модель, тем меньше она полагается на заученные движения и тем лучше понимает общие физические принципы — баланс, инерцию, распределение нагрузки.
Skild AI основана в 2023 году выходцами из Карнеги — Меллона. Оба сооснователя — действующие профессора CMU: CEO Дипак Патхак специализируется на обучении с подкреплением и «любопытстве» как внутренней мотивации агента, президент Абхинав Гупта — на крупномасштабном визуальном обучении и роботизированных манипуляциях.
Источник: QbitAI (🇨🇳)
#SkildAI #NVIDIA #Messinator #робототехника #усиленноеобучение
Post #2862
9