TGViewer
Gnezdo Hub by Bottlecruiser | ex Crypto Mokakke Gnezdo Hub by Bottlecruiser | ex Crypto Mokakke @cryptomokakke · 3.73K subscribers
Post #938 597
😎 Как юзать GPT-5.6-Sol и не упираться в лимиты

Я сжег токенов более чем на $200,000 в gpt-5.6-sol... хотел бы я написать, но к сожалению — это лишь начало статьи из твиттора, перевод которой и будет далее.


Модель потрясающая. Тем не менее, даже на подписке Codex Pro за $200 исчерпать лимиты — проще простого. OpenAI щедро идет навстречу с обнулением лимитов, но это слабо утешает, когда ты полностью убиваешь свое 5-часовое окно за первый же час.

Я сам совершил кучу ошибок и вижу, как на те же грабли наступают другие. Со временем я сниму об этом подробное видео, но сейчас хочу поделиться инсайдами как можно скорее, чтобы вы успевали делать больше, сжигая при этом меньше.

🐑 Уровни рассуждений

По умолчанию ставьте Medium или High. Оба варианта работают отлично. Уровень Xhigh невероятно мощный, но на практике он нужен редко — даже когда вы оркеструете целую сеть субагентов (об этом ниже).

💪 Режим «Ultra»

Несмотря на то, куда разработчики запихнули Ultra в интерфейсе, это не уровень рассуждений. Из-за этого возникает такая же путаница, как и с «Ultracode» в Claude Code. Скоро у меня выйдет видео на эту тему.

Пока что я настоятельно рекомендую вообще избегать Ultra. В самой обвязке (harness) Codex сейчас есть баги, из-за которых модель спавнит слишком много субагентов, причем с неоправданно высоким уровнем рассуждений. Я вернусь к этому режиму, когда баги пофиксят.

🕶 Быстрый режим

Я обожаю Fast mode и раньше часто его гонял. Он имел смысл для моделей, которые постоянно спотыкались и зависали, прежде чем сжечь кучу ресурсов. Но напомню: Fast mode списывает баланс в 2.5 раза быстрее.

Если версия 5.5 часто останавливалась и требовала пинка («продолжай»), то 5.6 способна фигачить НАМНОГО ДОЛЬШЕ. В целом это круто: ей можно доверить задачи *end-to-end* (под ключ). Но из-за этого расход токенов (*token burn*) становится крайне непредсказуемым.

Если не брать в расчет команду /goal, то в версии 5.5 одно сообщение съедало от 0.1% до 2% от моих лимитов. С учетом мультипликатора 2.5x на пике выходило около 5% за сообщение.

В 5.6 я видел, как одно-единственное сообщение сжирало до 15% лимита, просто потому что модель уходила в глубокие и долгие рассуждения. Включите здесь Fast mode — и вы потеряете 40% своего 5-часового окна за один запрос. Я знаю, что на этом погорело уже очень много народу. Поверьте мне: временно забудьте про Fast mode.

👠 Субагенты

Это главная фича и самый крутой анлок в GPT-5.6. Но и выстрелить себе в ногу здесь проще всего. Sol очень уж любит плодить субагентов. В основном это плюс.

К сожалению, текущая имплементация в Codex — это настоящий клубок проблем (я уже молчу про разделение на v1/v2 и автолейблинг/роутинг на основе моделей).

tl;dr: gpt-5.6-sol ВСЕГДА спавнит субагентов с той же моделью и тем же уровнем рассуждений, что и у родительского инстанса. Именно поэтому Ultra сейчас «сломан».

🏆 Лайфхаки

🟢Снижайте уровень рассуждений! Уровень High с субагентами работает еще терпимо, но Low и Medium — вообще идеально.
🟢Обновите свой глобальный файл AGENTS.md, прописав туда жесткую инструкцию: «only spawn subagents when I ask you to» (создавать субагентов только по прямому запросу). Это охладит траханье пыл 5.6.
🟢Если вам позарез нужно, чтобы Codex разворачивал многоуровневую сеть агентов, включите флаг hide_spawn_agent_metadata = false в конфиге. Спросите у самого Codex, как это сделать, он разберется (возможно, потребуется доступ к исходникам).

Я сейчас активно общаюсь с командой Codex, чтобы они пофиксили это поведение. Ну а пока мне приходится использовать слегка абсурдные костыли.

🚬 Выбор модели

Сам я по-прежнему юзаю gpt-5.6-sol для 90% задач. Изредка переключаюсь на Terra для быстрого ревью или фидбека — обычно просто ради любопытства. Luna на удивление хороша, но она создана не для того, чтобы мы выбирали её руками; это скорее инструмент для работы с кодом и утилита, которую Sol сама вызывает в качестве субагента.

🟢 Мой совет: выбирайте Sol High, если вы на тарифе за $200, и Sol Low во всех остальных случаях.
🟢 Terra Medium выглядит неплохим вариантом для экономии лимитов и выжимания максимума, но я тестил её слишком мало, чтобы утверждать наверняка. (Кстати, все эти варианты обоссывают Sonnet и Opus как по уму, так и по цене).

👨‍🎨 Промптите грамотнее

Эта модель будет писать код бесконечно, пока не иссякнут лимиты. Поэтому критически важно закладывать в промпт четкие точки остановки (stop points). Вот пара примеров:

🟢«Я хочу, чтобы ты написал эту фичу. Начни с составления плана. Как только план будет готов, остановись и спроси у меня фидбек, прежде чем идти дальше».*

🟢«План супер, погнали реализовывать. Используй computer use для тестирования. Работай до тех пор, пока код не заведется и результат тебя не устроит. Создай PR, дождись первых комментов на ревью и поправь их. После первого круга ревью остановись, дальше я подхвачу сам».

Обратите внимание, насколько эти задачи отличаются по масштабу и длительности. 5.6 умеет играть «вдолгую» и делает это круто! Но иногда её заносит, так что четкие стоп-сигналы ей жизненно необходимы.

⌨️ Пусть рулит другой агент

Tl;dr: если у вас есть другая подписка, посадите за руль Fable. Научите её вызывать субагентов через gpt-5.6 (или используйте Cursor, он и так это умеет).

Я сам прыгаю между несколькими подписками (2x Claude по $200 и 1x Codex за $200). Fable тоже жрет токены как не в себя, но если гонять её на низких уровнях рассуждений и натренировать на вызов субагентов Codex, получается мощнейшая связка. Я подробно разбирал это в недавнем видео про максимизацию эффективности Fable — сейчас эти советы актуальны как никогда.

😨 Крутите настройки, пока не станет по кайфу

Эксперименты сейчас решают всё. Пробуйте разные подходы, закидывайте модели хардкорные таски, мониторьте лимиты (через дашборды, ccusage, codexbar или как вам удобнее). Вы удивитесь, насколько мелкие изменения в конфигах могут повлиять на качество аутпута и скорость сжигания токенов.

Сейчас чертовски интересное время для разработчиков. Кайфуйте. Проводите больше времени в директориях ~/.codex и ~/.claude. Делайте изменения, которые кажутся бредовыми. Тестируйте. Результаты вас поразят.

🦧 | Gnezdo Hub

Агрегаторы
| Терминал
Чтиво | Трейд | Чатик
  • ❤ 5
  • 🔥 2
More from @cryptomokakke
  1. Sep 17, 2026🚬 Дайджест для уважаемых людей #daily | Бустани канал! 👋 📊 Макро 🇺🇸 S&P 500: 7,551.81…
  2. Sep 16, 2026🚬 Дайджест для уважаемых людей #daily | Бустани канал! 👋 📊 Макро 🇺🇸 S&P 500: 7,585.73…
  3. Sep 15, 2026🚬 Дайджест для уважаемых людей #daily | Бустани канал! 👋 📊 Макро 🇺🇸 S&P 500: 7,619.98…
  4. Sep 14, 2026🚬 Дайджест для уважаемых людей #daily | Бустани канал! 👋 Рынки замерли перед заседанием…
  5. Sep 13, 2026🚨 НАБОР В GEM HUNTERS ОТКРЫТ Если ты еще не устал от крипты, и готов дегенить в оживающем…
  6. Sep 11, 2026🚬 Дайджест для уважаемых людей #daily | Бустани канал! 👋 📊 Макро 🇺🇸 S&P 500: 7,591.70…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →