TGViewer
Junior AI PM Junior AI PM @junior_pm · 7.36K subscribers
Post #487 5.24K
#мнение
Сейчас Codex лучше Claude Code

Здравствуй, неподгоревший читатель. Этот пост про то что сейчас рабочая лошадка из фронтир моделей. Также ответ на Пашино https://t.me/evilfreelancer/1846

Если нужен один дефолт -> GPT-5.6 Terra в Codex Pro с medium usege без Fast mode. Мое глубокое субъективное имхо на 3 августа 2026. По кредитной шкале при одинаковом токенном профиле Sol : Terra : Luna = 25 : 10 : 1: Terra жжет в 2,5 раза меньше Sol. При этом на SWE-Bench Pro (если он для вас аргумент) у нее 63,4% против 64,6% -> отдали 1,2 п.п. качества, получили 2,5x емкости лимита

Ближайший аналог у Claude -> Sonnet 5, но его стоит доставать под мутный скоуп и широкий рефакторинг. А также по личным расчетам через
ccusage стоимость задачи $0.50–1.5+ (с ретраями) и порядка 2% лимита на тарифе в $100 против $1–3 у Sonnet 5

Арифметика дальше проверок была на отдельном аккаунте с $20 подписками:

- На Plus фикс в 400 строк через Sol Medium на 5000 строковом проекте на расте съел 15% пятичасового лимита;
- Luna Extra High за 25 минут написала 2500 строк с тестами за 5% недели, следующие этапы жрали по 2–6%, а ревью Sol и исправление найденного добра -> еще 4% + 5%
- Сопоставимый блок на Opus 5 High съел 35% пятичасового и 4–5% недельного лимита.

В интернете примерно тоже самое говорят. Там таже Terra Medium уничтожила всю неделю Plus за шесть часов, пока пользователь Pro гонял Sol Extra High по 6–8 часов в день больше недели без упора в кап. Главный множитель -> тариф, контекст и число переделок. Luna дешевая, пока после нее не приходится звать взрослую модель с веником и как тут жалуются

Еще сильнее модели влияет агентная оболочка. Некий Composio прогнал один Kimi K3 через три оболочки на 28 одинаковых задачах: успехи почти равны — 22/28 у Kimi Code, 21/28 у Hermes, 20/28 у Claude Code; медиана расхода -> 61k, 67k и 340k токенов, время -> 297, 179 и 348 секунд. Claude Code сжег в 5,6 раза больше токенов ради почти того же результата. В следующем тесте Codex против Claude Code на 26 задачах Claude взял 19/26, Codex 17/26, но тратил 347 против 236 секунд -> примерно 7,6 против 10 успешных задач в час. Claude точнее на 7,7 п.п., Codex производительнее на 32%. Серия твитов отсюда

При этом Claude Max способен быть безумно выгодным: один жосткий пользователь прогнал через Claude Code 21,5 млрд токенов, заплатив около $1000 за подписки https://x.com/wecko_ai/status/2083783073800585326. Но миллиарды токенов не равны миллиардам пользы: длинная история, повторные чтения, кеш и сабагенты прекрасно превращают Max в тыкву за одну жирную сессию

И лайфхак: обычный чат с Sol Extra High и Codex расходуют разные пулы, поэтому подключаем GitHub, включая разрешенный приватный репозиторий, делаем ресерч, архитектуру и прототип в чате, а готовый план отправляем Terra в Codex.

P.S. Sol Extra High под пиво -> Terra в шахту, Fable 5/gpt 5.6 Sol бесполезные релизы. От @vozzynebot подсказали https://cursor.com/evals, но тут опять все вопрос веры и личной практики
  • 💩 8
  • 👍 6
  • 😁 2
  • 🤡 1
  • 🥴 1
More from @junior_pm
  1. Sep 21, 2026Комьюнити-эфир 24 сентября. А нужны ли вообще AI-комьюнити? Глеб строит закрытую AI-Лабу с…
  2. Sep 20, 2026#рецепт Модель уровня opus 5 бесплатно. swe-2 в devin, но есть нюансы На выходных многие л…
  3. Sep 15, 2026Есть ли у вас для меня вакансия? Я ищу работу Как проджект я сеньор, как техпроджект, наве…
  4. Sep 14, 2026#мнение Я крайне скептически отношусь к разговорам про корпоративную культуру Это быстро с…
  5. Sep 3, 2026Комьюнити-эфир 3 сентября. Управление AI-сетапами: релиз open-source ai-stp Покажем AI STP…
  6. Sep 3, 2026#иное Решил попозориться сегодня, сколько уже можно тянуть, целых 3 недели делали зачаток…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →