@dulick - sup
@ya_kover - lil sup
Стабильные модели, лучшая скорость и дешевые цены
👁🗨Сервис - https://clodex.xyz
💬Наш чат - https://t.me/+zbr3jbycDh5jM2U6
🇺🇸 EN - t.me/clodex_api_en
🇨🇳 CN - t.me/clodex_api_cn
Dev/Tech - @clodex_labs
Post #11
222

Честный кэш контекста в Clodex
В агентном кодинге большая часть запроса повторяется снова и снова: системный промпт, tool-схемы, история диалога, правила проекта и контекст файлов.
Обычная тарификация считает это как обычные prompt tokens.
В Clodex cached tokens учитываются отдельно и списываются дешевле.
Это особенно заметно в:
Codex, Cursor, Claude Code, Cline и других coding agents.
Как это работает у нас:
Итог простой: в длинных coding-сессиях баланс живет дольше, потому что повторяющийся контекст не сжигается как новый каждый раз.
Мы не кэшируем ответы и не подменяем результат.
Экономия идет именно за счет prompt cache: модель отвечает на актуальный запрос, а уже знакомая часть контекста тарифицируется мягче.
В агентном кодинге большая часть запроса повторяется снова и снова: системный промпт, tool-схемы, история диалога, правила проекта и контекст файлов.
Обычная тарификация считает это как обычные prompt tokens.
В Clodex cached tokens учитываются отдельно и списываются дешевле.
Это особенно заметно в:
Codex, Cursor, Claude Code, Cline и других coding agents.
Как это работает у нас:
GPT-5.4 — x1
GPT-5.5 — x2.25
GPT-5.4 mini — x0.45
Claude Sonnet / Haiku / Opus — x1
А повторяющийся cached context считается по сниженной ставке.
Для GPT-5.5 cached tokens списываются примерно как x0.9, то есть заметно дешевле обычных x2.25.
Итог простой: в длинных coding-сессиях баланс живет дольше, потому что повторяющийся контекст не сжигается как новый каждый раз.
Мы не кэшируем ответы и не подменяем результат.
Экономия идет именно за счет prompt cache: модель отвечает на актуальный запрос, а уже знакомая часть контекста тарифицируется мягче.
- 👍 2
- 👎 1





