А что если обучать AI-агентов на обычном ноуте было бы так же просто, как на GPU-кластере?
Команда из UIUC U Lab под руководством проф. Jiaxuan You выложила в опенсорс OpenTinker.
Это новая система формата Reinforcement-Learning-as-a-Service (RLaaS), которая разбивает тяжелый RL-пайтлайн на простые распределенные сервисы с удобными API.
Итог — снимает большую часть инженерных болячек вокруг RL, обгоняя классические фреймворки по доступности и простоте деплоя, наконец-то делая обучение агентов реалистичным вариантом для обычных разработчиков и команд.
Project: https://open-tinker.github.io/opentinker-page/
Code: https://github.com/open-tinker/OpenTinker
U Lab: https://github.com/ulab-uiuc
👉 @PythonPortal
Post #5367
9.66K
- ❤ 9
- 👍 6