📊 Сравнительная таблица Ростера OpenAI моделей на разных бенчмарках
Источник
Я много пользуюсь для кодогенерации по API, тоже для бенчмарков, и в целом корреляция стоимости токена модели с финальным качеством действительно похожа на репорты с открытых бенчмарков.
Субъективно, эффективность/компактность/ instruction following генерируемого кода у гпт моделей тоже лучше, чем у Антропиков. И при этом у всех оставляет желать лучшего.
Post #75
2.05K

- ❤ 4
- 🆒 4
- ✍ 3
- 👍 3
- 👏 2
- 💯 1