Также напишу про пару других свежих работ в сфере пространственного ИИ:
Команда из Stanford, University of Washington и Cornell опубликовала для ICLR 2026 бенчмарк с громким названием Theory of Space. Он посвящен поиску ответа на вопрос, способны ли языковые модели самостоятельно исследовать незнакомое пространство и строить его связную карту так же, как это делают люди. Причем это делается в достаточно упрощенных симуляционных средах.
Исследованы 6 топовых моделей: GPT-5.2, Gemini 3 Pro, Claude Sonnet 4.5, GLM-4.6V, Qwen3-VL-235B и InternVL 3.5-241B. Вывод такой, что активное исследование пространства пока им не поддается
- Страница проекта
- Статья
- Датасет
- GitHub
#References
Post #425
305

- 🔥 3
- 👍 1