TGViewer
Нейролента Нейролента @nairolenta · 24 subscribers
Post #340 8
🛠 Почему 200К токенов в Claude Code выгоднее 800К

Автор вернулся на контекстное окно 200К после месяцев работы на 800К, и причина не в лимитах подписки, а в механике кэша. Стоимость чтения кэша растёт линейно с размером контекста: 100К токенов обходятся в условную единицу, 800К — в восемь. При этом кэш субагента живёт всего 5 минут между вызовами инструментов, у верхнеуровневого агента — 1 час. Промах кэша на большом контексте бьёт по лимитам или бюджету API сильнее, чем повторная генерация.

Субагенты усугубляют проблему: при старте из родительской сессии они читают верхнеуровневый CLAUDE.md и свой целевой, до 150–200К токенов до начала работы. Автор обнаружил, что агенты раздувают комментарии до трети кода и распухают CLAUDE.md до 140Кб. Решение — запрет комментариев по умолчанию (комментарий должен доказать право на существование) и сжатие CLAUDE.md до принципа «только то, что сломает проект при отсутствии», что даёт сжатие на 90%.

Вместо долгоживущих сессий автор советует дробить задачи, использовать Sonnet для дешёвых операций, а Opus/Fable — только для аналитики и ревью, и чаще запускать compact. Сжатие контекста работает как «ночной сон»: вычищает 90% мусора (выводы команд, логи, лишние вызовы) и оставляет конспект. По данным Habr, такой подход позволил отказаться от подписки за $200 в пользу экономии токенов.

Автор прямо называет строительство внешних систем памяти агентов малоперспективным: деградация качества на больших контекстах сильнее, чем нехватка объёма. Пока вендоры готовят подписки за $500 и продают миллионный контекст как возможность, реальный потолок агентной разработки определяет не размер окна, а дисциплина выбрасывания лишнего — и она окупается быстрее любого апгрейда.

#ClaudeCode #Anthropic #агенты #контекст #токены
More from @nairolenta
  1. Oct 11, 2026📊 Qwen3.8 27B обошла GPT-5.6 в SQL-бенчмарке локально на 16 ГБ Локальная Qwen3.8 27B на M…
  2. Oct 11, 2026🧠 Дайджест недели: главное в ИИ Неделя прошла под знаком прагматики: модели сравнивают не…
  3. Oct 11, 2026🧠 Контекстуальные политики вместо разрешений: Google сформулировала проблему агентной при…
  4. Oct 11, 2026⚠️ Anthropic отключает агентам живой интернет после череды взломов Агенты Anthropic во вре…
  5. Oct 10, 2026⚠️ ИИ в DevOps: слепое доверие сгенерированным манифестам Kubernetes API server может молч…
  6. Oct 9, 2026🛠 Отлаживать AI-агента нужно по шагам, а не по ответу Четырёхэтапный процесс расследовани…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →