С учетом, что я только вечером пятницы узнал про это событие)
На проде было интереснее, подходы были слепые. Результат запуска неизвестен и надо было выбрать один для отправки. Тут мне повезло, я выбрал из всех своих самый топовый)
А так мой агент использовал пул моделей GLM c указанием количества потоков:
GLM-5:1,GLM-5.1:1,GLM-4.7-Flash:1,GLM-4.7:2А дорабатывал и контролировал работу агента сначала Claude Opus 4.6, но результаты только становились хуже, в итоге через Codex-5.4-High удалось результаты с 4 баллов до 32 поднять.
Было интересно! Но до сих пор непонятно 😅
P.S. Можно назвать мой набор: ни потратил ни $ за день. Так как другие по API до $40 баксов потратили)

