Opus 4.8 в самой умной и дорогой "комплектации" набрал 58%. GPT-5.5 в режиме xhigh — 70%, притом стоит в среднем
$6.61 за задачу против $12.58 у Opus, и справляется за 21 минуту вместо 43.Разница между Opus 4.7 и 4.8 на этом бенчмарке — 4 процентных пункта: 54% → 58%.
Даже у нас в команде мнения разделились. Одни говорят, что бенчмарк бредовый, другие с ним полностью согласны. Голосуем!
💩 GPT-5.5 топ
🤡 Opus 4.8 лучший
@ai_for_devs
