ОТКРЫТЬ ИСХОДНЫЙ КОД И ВЕСА НЕЙРОСЕТЕВОЙ МОДЕЛИ ДЛЯ УПРАВЛЕНИЯ ГРИНОМ?
> yes
Green-VLA — это модель класса Vision-Language-Action. Она позволяет роботу видеть окружающую среду, понимать команды на естественном языке и совершать физические действия.
Что по технической части?
🟣 Основа архитектуры — трансформер Qwen3-VL-4B
🟣 Он предсказывает действия робота в реальном времени с помощью технологии flow-matching
🟣 Обучение проходило в пять этапов — от мультимодальных веб-данных вплоть до датасетов реальных роботов
Базовую модель можно дообучить под другого робота — например, для работы на производстве или складах.
🤩 Код доступен на GitHub
🤩 Веса — на Hugging Face
Проект опубликован под лицензией MIT 🤩
> no
Неправильный ответ. Штраф — ❤️
✔️ Подписывайтесь на Sber AI в MAX
