Всем привет!🔥
📆 Сегодня (30.01) в 17:00 Татьяна Земскова и Алексей Староверов проведут:
Разбор решений BEHAVIOR-1K Challenge
Vision-language-action (VLA) модели показали перспективные результаты в решении базовых задач планирования действий: манипуляции и навигации. Но отдельных робототехнических навыков недостаточно для решения высокоуровневых бытовых задач, требующих последовательного выполнения отдельных подзадач для достижения цели. На этой встрече мы поговорим о соревновании BEHAVIOR-1K Challenge (NeurIPS 2025) — одном из ключевых соревнований в области Embodied AI. BEHAVIOR-1K — это бенчмарк из 1000 бытовых задач в реалистичной симуляции, где агенту нужно планировать длинные цепочки действий, ориентироваться в среде и физически взаимодействовать с миром.
Мы рассмотрим сам бенчмарк и соревнование BEHAVIOR-1K Challenge, а также обсудим две работы, которые были представлены к дедлайну соревнования, но будем обсуждать их последние post-challenge версии, где авторам удалось улучшить метрики.
⚫️Сначала коротко рассмотрим решение победителей челленджа, фокусирующееся на адаптации vision-language-action модели под задачи BEHAVIOR-1K и дающее существенный прирост качества за счёт архитектурных и inference-трюков.
⚫️Вторая работа — альтернативный подход от команды Openpi Comet, также показавший высокий результат. Авторы этого подхода сделали упор на исследование влияния различных входных модальностей и метода обучения модели с использованием новых данных демонстраций из симулятора.
Статьи:
1. BEHAVIOR-1K: A Human-Centered, Embodied AI Benchmark with 1,000 Everyday Activities and Realistic Simulation
2. Сайт BEHAVIOR
3. Task adaptation of Vision-Language-Action model: 1st Place Solution for the 2025 BEHAVIOR Challenge
4. Openpi Comet: Competition Solution For 2025 BEHAVIOR Challenge
🍿Ссылка на подключение
Подписаться⤵️
Embodied AI Reading Club
Post #61
1.57K

- 👍 8
- 🔥 8
- ❤ 2