TGViewer
OpenClaw и Hermes канал про ИИ-агентов OpenClaw и Hermes канал про ИИ-агентов @openclawc · 350 subscribers
Post #372 96

Forwarded from Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo

Как сэкономить токены в Claude Code ультимейт гайд

Основанный на моем более чем 1.5 годовом опыте работы с КК.

Поймите, основная статья расходов - это не генерация новых токенов - это чтение из кэша. Уже писал об этом тут.

Как это вообще происходит? В агентом цикле КК снова и снова перечитывает всякий мусор:
• Он шарахается по интернету и от туда все пылесосит в контекст
• Он шарахается по жесткому диску и все собирает.
• Его просто циклит на ровном месте.

Писал об этом тут.

Чтобы бороться с циклами я даже сделал отдельный проект, но он пока не готов.

КК имеет 2 типа кеша:
• стандартный 1 часовой - просто не отходите от КК больше чем на час, а если ушли на долго запускайте компактацию.
• 5 минутный для агентов. Просто не запускайте агентов самостоятельно. КК делает это сам автоматически когда нужно.

Подробнее про кэш.

Как сэкономить еще больше:

1. Начните с команды /context она показывает, чем вообще засрано. Так я обнаружил, что мой самописный MCP содержит в себе 134 туда с очень жирными описаниями, и вот это просто пассивно отжирало лимиты. все эти скиллы и мсп вы просто платите пассивный налог на каждый. писал об этом тут.
2. Команда /insights там КК выдает вам тонну советов, в том числе и по сокращению потреблению лимитов.
3. /skill-doctor - проверяет не жрут ли скиллы, скорее всего не жрут, но проверить стоит.
4. Не устанавливайте всякие сомнительные инструменты для "экономии токенов" из интернета. Как я обжогся с Headroom больше экспериментов не хочу (хотя в блог писать надо). А например в скилле superpowers (не знаю как сейчас, но раньше так было) дефолтная разработка была субагентами, а там кэш 5 минут, и лимиты это выжирало мгновенно. Не знаете как это работает — лучше не запускайте, вот что я для себя усек.

Для что я могу посоветовать для экономии токенов:

скил понитейл — как это работает? он сокращает написание кода. А значит меньше кода будет записано в контекст, и меньше контекста попадет в циклы. сам автор называет скромные цифры 20-30% экономии, но меня вдохновило сообщение в чате, там человек писал что перепробовал и стоунмэн, и сирена и кодеграф, реально экономит только понитейл.

команда /simplify - она проверяет код на задублирование, меньше кода - меньше мусора в кэше.

И заметьте ни слова про CLAUDE.md (писал тут) и /memory (еще не писал) т.к. это уже должно быть очевидно.

Если после прочтения этой статьи вам не удалось сэкономить токены — требуйте от меня возврата денег за чтение!
  • 👍 1
  • 🔥 1
More from @openclawc
  1. Jun 13, 2026Сижу я за своим Маком работаю и тут что-то начинает шарится по моим личным папкам Я по Pyt…
  2. Jun 11, 2026Попользовался этим Hermes Desktop с неделю - все очень очень сыро То что обновляется кажды…
  3. Jun 9, 2026На Хабре вышел толковый пост Hermes Agent Desktop: настройка под реальные задачи Автор мес…
  4. Jun 6, 2026Компания Nous разработавшая агента Hermes выпустили Desktop App Я протестировал - мне очен…
  5. Jun 6, 2026Channel name was changed to «OpenClaw и Hermes канал про ИИ-агентов»
  6. May 5, 2026📊 AI Агенты 2026: Взрыв OpenClaw и новая эра автономности OpenClaw продолжает покорять ми…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →