OpenAI выпустили MLE-bench - новый сложный бенчмарк для LLM.
По сути это бенчмарк в котором одни модели должны учиться обучать другие модели. Ну то есть обучать себе подобные системы.
o1 выбивает уже неплохие 16.9% бронзовых мест в их наборе Kaggle соревнований.
Что там по сингулярности?
Post #98
2.52K
- 🔥 5
- 🤯 5
- ❤ 4
- 🤨 1