TGViewer
Futuris Futuris @futuris · 6.43K subscribers
Post #5037 1.47K
🤯 Нашёл, куда утекают лимиты Claude Code, и это касается всех, кто гоняет субагентов. По наводке из треда проверил свои логи и офигел. Основной чат Claude Code держит кэш контекста час, а субагенты-помощники — всего 5 минут!😱 Стоит помощнику постоять дольше пяти минут (ждёт мой ответ, долгие тесты или сборку), и следующий шаг заново записывает в кэш весь его контекст, сотни тысяч токенов, а такая запись примерно в 12 раз дороже обычного чтения из кэша!!!! У меня субагент на Opus, который пилит камеру в моей AI-DnD, за два дня записал в кэш 116,6 млн токенов и 159 раз перезаписал контекст целиком, по 200–900 тысяч токенов за раз. Похоже, именно это и съело недельный лимит Max 🫣 Решение официальное, есть в документации Claude Code: в settings.json добавить "subagentPromptCacheTtl": "1h", а если гоняете агентов через API-ключ, то CLAUDE_CODE_PROMPT_CACHE_TTL=1h. Запись в часовой кэш дороже, но полных перезаписей после каждой паузы больше нет. Проверил: кэш действительно пошёл с ephemeral_5m на ephemeral_1h. Чудес не ждите: у моего лейна это срежет примерно 20–25% расхода, потому что основное съедает раздутый до 900 тысяч токенов контекст, который читается на каждом шаге. Поэтому вторая мера: не вести одного агента сутками, а давать каждый шаг свежему агенту с коротким отчётом предыдущего 🔄
📄 Документация: https://code.claude.com/docs/en/prompt-caching

P.S.
Заодно для Opus 5.5 раскатили Fast mode: тумблер в меню модели или /fast в терминале. Та же модель и то же качество, только около 285 токенов/с, в 2–2,5 раза быстрее. Стоит вдвое дороже ($8 / $40 за миллион токенов), а на подписке в лимиты не входит и списывается только с usage credits ⚡️

P.P.S
Прежде чем внедрять всё вышесказанное в свой флоу, посоветуйтесь со своим агентом, тк то что оно подошло мне не значит, что подходит сразу всем
Claude Code Docs How Claude Code uses prompt caching - Claude Code Docs Claude Code manages prompt caching automatically. See why a model switch triggers a slow uncached turn, what /compact costs, why CLAUDE.md edits don't apply mid-session, and how to check your cache hit rate.
  • 👍 10
  • 🔥 4
  • ❤ 3
More from @futuris
  1. Oct 9, 2026тем временем OpenAI добавили функцию предложения следующего сообщения на основе контекста…
  2. Oct 9, 2026Anthropic выкатили в открытую бету dynamic workflows для Claude Managed Agents: даёшь аген…
  3. Oct 9, 2026С 12 ноября Anthropic запретит систематически издеваться над Claude, но критиковать ответы…
  4. Oct 9, 2026Помните репликаторы из Star Trek🖖? Atomic Machines пытается сделать первые шаги в эту сто…
  5. Oct 9, 2026Google решил сожрать весь офисный планктон разом😎 Компания Google представила Gemini agen…
  6. Oct 8, 2026Папа Лев тему говорит, прежде чем мы сможем считать модели по-настоящему интеллектуальными…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →