TGViewer
Вайб-кодинг Вайб-кодинг @vibecoding_tg · 63.9K subscribers
Post #3043 12K
🤭 Claude Code стал использовать в 3 раза меньше токенов после одного изменения:

Было: 10.4M токенов · 10 ошибок · $9.21
Стало: 3.7M токенов · 0 ошибок · $2.81

Причина не в модели.
Проблема в том, как бэкенд отдает информацию агенту. Когда контекст неполный, более сильная модель не игнорирует этот пробел.

Она тратит больше токенов на рассуждения о недостающем контексте, запускает больше исследовательских запросов и чаще уходит в ретраи. Поэтому нехватка контекста не исчезает с переходом на более сильную модель — она просто начинает обходиться дороже.

Вот разбор, почему бэкенды становятся поглотителем токенов для агентов, как выглядит альтернативная архитектура и какая разница по стоимости получается на реальном проекте.

*В качестве слоя контекстной инженерии использовались Insforge Skills + CLI (open-source, локально)
More from @vibecoding_tg
  1. Oct 6, 2026Жирный котяра уже здесь. 🍿 Mistral представила новую модель — Mistral Large 4, она же Le…
  2. Oct 6, 2026Post #4032
  3. Oct 6, 2026Подписки Anthropic более чем в пять раз выгоднее подписок OpenAI. 🫣 Ещё в июне преимущест…
  4. Oct 6, 2026Кто то уже зареверсил продукты Adobe: https://getartcraft.com/apps Теперь у всего будет ве…
  5. Oct 6, 2026Astra и GPT-6.1 Sol теперь должны работать примерно в полтора раза быстрее — выдавать окол…
  6. Oct 5, 2026Это сгенерировал американский ИИ:
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →