GPT-5.2 сильнее GPT-5.4
Прогнал множество разных тестов: Речь не о том что обычно проверяют блогеры говоря о качестве модели (ни кто лучше нарисовал SVG или сделал красивый UI), а речь скорее о том, насколько модель реально качественно,эффективно и нестандартно решила бекенд задачу со сложной взаимозависимой логикой.
GPT-5.4 по результатам всегда делает "красивые прыжки", но постоянно "приземляется на голову" и ломает себе шею.
По сути это вероятно говорит о том что модель сама по себе качественная, но она чрезмерно квантована что привело к очень заметной потере качества что модель уступает даже GPT-5.2
Codex 5.3 постоянно скатывается в хаки и жульничество, хотя в целом тоже делает хорошие,качественные вещи, но как правило добивается их путями которые противоречат намерениям пользователя.
GPT-5.2 думает заметно дольше остальных и дает ответы куда более осмысленные и направленные на исполнение намерений пользователя, чем просто Changelog списком, как это практически всегда делает GPT-5.4 что просто вымораживает
Post #70605
37
Forwarded from Tlinov (Magray)
