итак, наконец-то вышли новые модельки от наших любимых OpenAI - это gpt 5.6 sol, terra и luna
среди всех этих моделек нам, конечно же, интересна ТОЛЬКО самая крутая - gpt 5.6 sol, именно поэтому я жестко тестил ее
самое первое, что я заметил - она конченная
конченная в плане того, насколько плотно она за задачу держится и как много tool calls она делает... это просто жесть
для сравнения вам - на одинаковой задаче gpt 5.5 сделала бы 20 вызовов, эта же gpt 5.6 бимба сделает раза в два-три больше. А, ну и тесты она проводить очень любит
хорошо ли все это?
с учетом того, что она стала еще экономнее расходовать токены, а также с учетом того, что вызов тулов ей очень хорошо подкрутили - это ОЧЕНЬ круто
ребятки явно провели огромную работу над моделькой, не зря ведь откладывали дроп моделек столько раз
а теперь самый важный вопрос - стала ли она умнее?
если смотреть именно по ваншот промптам, то нет, я не заметил каких-то взрывных улучшений, где с одного промпта я просто warface сделаю в браузере
если смотреть по итерациям, то умнее она стала, это да, я просто кайфанул. Но все также требуется следить че она там делает, чтобы не попасть в передрягу!
но если прям честно
она стала намного лучше понимать мой интент как юзера, ведь теперь даже если я просто скажу "братан, тут много обвязок и код грязный, давай чище", то он вычистит все то, что я считал сделанным плохо
но помните главную истину!
не одной моделькой ограничивается все, но еще и экосистемой вокруг этой модельки! В codex вышло очень много обновлений + режим work + еще много разных штук. Я уже потыкал это все и просто в шоке
не зря же я говорил еще в статье по вайбкоду, что кодекс дает жару! Ребята знают, что делают
так что в ближайшие дни ваш пананасик будет все тестировать на сложнейших задачках и в итоге выдаст вам плотнейший фидбек. Ожидайте
