🛠 Почему 200К токенов в Claude Code выгоднее 800К
Автор вернулся на контекстное окно 200К после месяцев работы на 800К, и причина не в лимитах подписки, а в механике кэша. Стоимость чтения кэша растёт линейно с размером контекста: 100К токенов обходятся в условную единицу, 800К — в восемь. При этом кэш субагента живёт всего 5 минут между вызовами инструментов, у верхнеуровневого агента — 1 час. Промах кэша на большом контексте бьёт по лимитам или бюджету API сильнее, чем повторная генерация.
Субагенты усугубляют проблему: при старте из родительской сессии они читают верхнеуровневый CLAUDE.md и свой целевой, до 150–200К токенов до начала работы. Автор обнаружил, что агенты раздувают комментарии до трети кода и распухают CLAUDE.md до 140Кб. Решение — запрет комментариев по умолчанию (комментарий должен доказать право на существование) и сжатие CLAUDE.md до принципа «только то, что сломает проект при отсутствии», что даёт сжатие на 90%.
Вместо долгоживущих сессий автор советует дробить задачи, использовать Sonnet для дешёвых операций, а Opus/Fable — только для аналитики и ревью, и чаще запускать compact. Сжатие контекста работает как «ночной сон»: вычищает 90% мусора (выводы команд, логи, лишние вызовы) и оставляет конспект. По данным Habr, такой подход позволил отказаться от подписки за $200 в пользу экономии токенов.
Автор прямо называет строительство внешних систем памяти агентов малоперспективным: деградация качества на больших контекстах сильнее, чем нехватка объёма. Пока вендоры готовят подписки за $500 и продают миллионный контекст как возможность, реальный потолок агентной разработки определяет не размер окна, а дисциплина выбрасывания лишнего — и она окупается быстрее любого апгрейда.
#ClaudeCode #Anthropic #агенты #контекст #токены
Post #340
8