В моем сетапе долгое время не было кодекса и начиная с января я подключил его «мидлом». Claude — главный мозг, планирует и декомпозирует, общаюсь с ним, а он уже запрягает Codex за $100 в месяц, который пишет код по готовому спеку и ревьюит то, что Клод написал сам.
Комбинация неплохая, все больше и больше приходит к консенсусу в зарубежном AI инфополе. Но есть одна проблема: последние пару недель я смотрю на счётчик лимитов кодекса и не понимаю, куда всё девается. Одна задача — минус 10–12% недельного лимита. День плотной работы — и недельный лимит закончился. Раньше лимитов на кодексе я не встречал никогда.
Причем у кодекса убрали 5 часовой лимит. И вот тут начинается самое интересное.
–––
Смотрите, какая красивая схема получается:
1. Убираем 5-часовое окно — метрика, по которой юзер чувствовал расход, исчезает.
2. Модель при этом тратит токены сильно быстрее старой (запомните этот пункт).
3. А чтобы никто не бухтел — регулярно сбрасываем всем лимиты. Лента в восторге: OpenAI щедрые, кодим бесконечно!
–––
Только лимиты сбрасывают не от щедрости, а когда случается говно. Последний сброс — извинение за аутедж 26 июля: серваки лежали два часа, и это был четвёртый сбой за четыре дня. В июне был баг — Codex писал диагностические логи со скоростью 640 ТБ в год и буквально убивал SSD разработчиков. Фикс выкатили частично, в твиттере до сих пор всплывают люди с мёртвыми дисками.
Еще немного про сам GPT 5.6. Даже ребята, которым дали Sol заранее и вообще без лимитов — Nerd Snipe (Theo и Ben, есть кто-то более популярный с техническим AI контентом сейчас?) тестили её на анлимите и максимальном reasoning и вынесли вердикт: «Самая плохая модель из Top tier, Fable — top of the top». За месяц Тео докатился от восторженного обзора до «Opus 5 is my new go-to model», и Sol у него теперь занимается ровно тем же, чем у меня — пишет код по чужому спеку.
Причем у каждой модели GPT в закрытом тесте есть особенность. Чем больше людей ей пользовалось, тем тупее она становится. На бета-тесте ресурсов хватает на всех, после релиза тот же компьют делится на миллионы юзеров. Что при таком раскладе достаётся нам с вами — вопрос риторический.
Отдельный кайф (нет) — выбирать, на чём вообще сидеть. Sol, Terra, Luna, у каждой reasoning от low до ultra. Я только-только научился выбирать reasoning, а теперь нужно еще умножить это на три модели. Сижу на Sol medium и не знаю, было бы мне лучше на Terra. У Anthropic в этом плане всё проще: универсальный Medium reasoning и Fable для сложных креативных задач, Opus для остального (зачем существует Sonnet — загадка).
Пост я начал писать во вторник и хотел закончить осторожным «может, мне всё это кажется». Ночью Тибо, глава Codex, закончил его за меня.
да, Sol тратит лимиты сильно быстрее, чем задумано, больнее всего power users на сложных задачах; вроде пофиксили, юсадж станет на ~18% длиннее, 5-часовое окно завтра возвращают.
И отдельная цитата из треда: «часть проблем становится видна, только когда моделью пользуются в реальном масштабе». Пункт 2 подтверждён официально.
Не показалось.