Бывало ли у вас такое, что агент “чуть-чуть помог”, а по факту 3 раза прогнал тесты, файлы и выжрал лимиты за 30 минут?
Я наконец собрал нормальный гайд, как реально экономить токены в Claude Code, Codex, OpenCode и других CLI и своих агентах через API
Что внутри:
🟡RTK: режем шум терминала до сути (и агент перестаёт видеть мусор)
🟡max-turns: предохранитель от бесконечных циклов “прочитал/проверил/повторил”
🟡Model routing: дорогую модель только на сложные шаги, остальное на дешёвые
🟡Prompt caching: как правильно собрать “стабильный префикс”, чтобы платить меньше
🟡Batch: как гонять фоновые задачи дешевле и пачками
🟡Сжатые tool outputs: вместо 1000 строк логов отдаём errors_count и топ ошибок
После этого ты перестанешь упираться в лимиты и начнёшь платить только за полезную работу
🔗Ссылка на статью:
https://teletype.in/@lum1nat3/ai_token_economy
https://teletype.in/@lum1nat3/ai_token_economy
https://teletype.in/@lum1nat3/ai_token_economy
Накидайте максимально реакций и комментариев. Если надо, сделаю продолжение. Всех обнял❤️
Valency Labs | Чат
