Эти чертяги опять это сделали. Они опять поменялись местами.
Честно, в последние месяцы у меня было ощущение, что мы потеряли OpenAI: Anthropic обогнали их по инструментам для рабочих задач и разработки, GLM-4.7 допинала уже поваленный на землю GPT-5.2 Codex в кодинге, Gemini забрала на себя общение и генерацию картинок, а ролевики вообще сидят на копеечных китайских моделях. Такое чувство, что на всём этом празднике жизни ChatGPT просто не осталось места. Только и осталось психозы с GPT-4o вызывать.
Рынок подумал так же, поэтому как из рога изобилия посыпались новости о том, что Nvidia передумала давать ClosedAI $100 миллиардов. Затем OpenAI запустила рекламу на бесплатном и новом $8 тарифе. В ChatGPT перестал работать режим мышления, и модель стала всегда выдавать мгновенные ответы. И даже этого OpenAI было мало, так что они продолжили себя закапывать, предложив платить комиссию за открытия, совершённые с использованием их LLM. По итогу всех этих событий я и ещё несколько людей, которых я знаю, отменили подписку на ChatGPT.
Представляю себе офис Anthropic на фоне новостей. Как они открывают бутылочку игристого, и тут музыка глохнет...
Opus 4.6 получился, мягко говоря, сомнительным. Да, в System Card они рассказывают о том, насколько модель получилась великолепной, как она опережает Opus 4.5 почти во всех аспектах... но по факту разницы я не заметил: модель как тупила на одних задачах (например, использовала неправильные команды в терминале, которые вообще не объявлены в проекте), так и продолжила это делать. Из реально интересных фич показали только 1М контекста, но, как вы уже знаете, это просто маркетинговая фишка.
И вот в попытках увидеть разницу между моделями я всё-таки заметил одно такое небольшоооое отличие: МОДЕЛЬ СТАЛА КАПЕЦ ДОРОГОЙ. Anthropic, по всей видимости, поняли, что установили слишком щедрые лимиты в своих подписках и нажали кнопку «oh, shit go back». Я за пару часов спокойной работы умудрился сжечь 30% недельных лимитов в $200 подписке, которую раньше сам же называл «бесконечной». Притом, что в прошлом году я запускал 10 сессий по 10 сабагентов в каждой из сессий параллельно и сжигал лимиты примерно с такой же скоростью. Что ж, это объясняет, для чего появилась эта модель и какие изменения в ней на самом деле произошли.
И я думаю, что Anthropic это сошло бы с рук, но кажется, что они недооценили противника. OpenAI под насмешки выпустили GPT-5.3 Codex и перевернули игру. Посмотрите на график, приложенный к посту. Вот это реальная, немаркетинговая революция.
На графике вы можете увидеть, что GPT-5.3 Codex не стала лучше решать задачи, при этом ей нужно в 4.5 раза меньше токенов, чтобы добиться того же результата. А это значит, что вы потратите в 4.5 раза меньше времени и денег на решение задачи, просто сменив модель. И вы не поверите, но это даже не главное достижение.
Помните, я рассказывал про то, как работает контекст? Так вот: GPT-5.3 Codex не нужно быть умнее, чтобы стать умнее. Она становится умнее за счёт того, что медленнее тупеет.
OpenAI буквально сказали: «Если мы не можем решить проблему с нашими финансами, context rot и скоростью ответов, давайте просто решим проблему с тем, насколько эффективно наши модели генерируют токены, а это решит все остальные наши проблемы». И они, чёрт возьми, справились.
И самое смешное во всей этой истории, что на поверхности ситуация выглядит так, будто именно Anthropic выпустили модель с 1М контекста, в то время как на деле она вышла у OpenAI. Причём вы вообще заценили, как элегантно они совершили этот квантовый прыжок?
Ну и учитывая то, что модели Anthropic в целом генерируют сильно больше токенов (у меня вообще Opus 4.6 работает исключительно как оркестратор сабагентов), то GPT-5.3 Codex ускакала настолько вперёд, что её будет ну очень сложно догнать. Даже как-то грустно за OpenAI: вроде совершили революцию, а вроде никому об этом и не расскажешь (вспоминается тот мем с чуваком в углу на вечеринке).
Anyway, гонка продолжается! Запасаемся попкорном и ждём, когда на сцене появится
