TGViewer
Женя, расскажи про AI Женя, расскажи про AI @that_ai_guy · 374 subscribers
Post #79 411
Oh, shit... Here we go again

Эти чертяги опять это сделали. Они опять поменялись местами.

Честно, в последние месяцы у меня было ощущение, что мы потеряли OpenAI: Anthropic обогнали их по инструментам для рабочих задач и разработки, GLM-4.7 допинала уже поваленный на землю GPT-5.2 Codex в кодинге, Gemini забрала на себя общение и генерацию картинок, а ролевики вообще сидят на копеечных китайских моделях. Такое чувство, что на всём этом празднике жизни ChatGPT просто не осталось места. Только и осталось психозы с GPT-4o вызывать.

Рынок подумал так же, поэтому как из рога изобилия посыпались новости о том, что Nvidia передумала давать ClosedAI $100 миллиардов. Затем OpenAI запустила рекламу на бесплатном и новом $8 тарифе. В ChatGPT перестал работать режим мышления, и модель стала всегда выдавать мгновенные ответы. И даже этого OpenAI было мало, так что они продолжили себя закапывать, предложив платить комиссию за открытия, совершённые с использованием их LLM. По итогу всех этих событий я и ещё несколько людей, которых я знаю, отменили подписку на ChatGPT.

Представляю себе офис Anthropic на фоне новостей. Как они открывают бутылочку игристого, и тут музыка глохнет...

Opus 4.6 получился, мягко говоря, сомнительным. Да, в System Card они рассказывают о том, насколько модель получилась великолепной, как она опережает Opus 4.5 почти во всех аспектах... но по факту разницы я не заметил: модель как тупила на одних задачах (например, использовала неправильные команды в терминале, которые вообще не объявлены в проекте), так и продолжила это делать. Из реально интересных фич показали только 1М контекста, но, как вы уже знаете, это просто маркетинговая фишка.

И вот в попытках увидеть разницу между моделями я всё-таки заметил одно такое небольшоооое отличие: МОДЕЛЬ СТАЛА КАПЕЦ ДОРОГОЙ. Anthropic, по всей видимости, поняли, что установили слишком щедрые лимиты в своих подписках и нажали кнопку «oh, shit go back». Я за пару часов спокойной работы умудрился сжечь 30% недельных лимитов в $200 подписке, которую раньше сам же называл «бесконечной». Притом, что в прошлом году я запускал 10 сессий по 10 сабагентов в каждой из сессий параллельно и сжигал лимиты примерно с такой же скоростью. Что ж, это объясняет, для чего появилась эта модель и какие изменения в ней на самом деле произошли.

И я думаю, что Anthropic это сошло бы с рук, но кажется, что они недооценили противника. OpenAI под насмешки выпустили GPT-5.3 Codex и перевернули игру. Посмотрите на график, приложенный к посту. Вот это реальная, немаркетинговая революция.

На графике вы можете увидеть, что GPT-5.3 Codex не стала лучше решать задачи, при этом ей нужно в 4.5 раза меньше токенов, чтобы добиться того же результата. А это значит, что вы потратите в 4.5 раза меньше времени и денег на решение задачи, просто сменив модель. И вы не поверите, но это даже не главное достижение.

Помните, я рассказывал про то, как работает контекст? Так вот: GPT-5.3 Codex не нужно быть умнее, чтобы стать умнее. Она становится умнее за счёт того, что медленнее тупеет.

OpenAI буквально сказали: «Если мы не можем решить проблему с нашими финансами, context rot и скоростью ответов, давайте просто решим проблему с тем, насколько эффективно наши модели генерируют токены, а это решит все остальные наши проблемы». И они, чёрт возьми, справились.

И самое смешное во всей этой истории, что на поверхности ситуация выглядит так, будто именно Anthropic выпустили модель с 1М контекста, в то время как на деле она вышла у OpenAI. Причём вы вообще заценили, как элегантно они совершили этот квантовый прыжок?

Ну и учитывая то, что модели Anthropic в целом генерируют сильно больше токенов (у меня вообще Opus 4.6 работает исключительно как оркестратор сабагентов), то GPT-5.3 Codex ускакала настолько вперёд, что её будет ну очень сложно догнать. Даже как-то грустно за OpenAI: вроде совершили революцию, а вроде никому об этом и не расскажешь (вспоминается тот мем с чуваком в углу на вечеринке).

Anyway, гонка продолжается! Запасаемся попкорном и ждём, когда на сцене появится 1.5 миллиарда китайцев DeepSeek.
  • ❤ 12
  • 👍 4
  • 🤔 3
More from @that_ai_guy
  1. Mar 13, 2026AlphaEvolve от Google DeepMind открыла новые нижние оценки для чисел Рамсея, улучшив резул…
  2. Mar 12, 2026В продолжение постов об исследованиях от METR На скриншоте — количество задач, которые мы…
  3. Mar 9, 2026Мы получили Cyberpunk 2077 в реальной жизни до выхода GTA 6 Помните бреиндансы из Cyberpun…
  4. Mar 7, 2026Кринж-METR 2/2 10 июля 2025 года METR выпускает новое исследование «Measuring the Impact o…
  5. Mar 7, 2026Кринж-METR 1/2 Есть такая организация, и вы сто процентов о ней слышали, если последний го…
  6. Mar 6, 2026Про качество кода от моделей Сегодня на созвоне вскользь поднимали тему качества кода от м…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →