Теперь при использовании текстовых моделей GPT и Codex закэшированная часть входного контекста стоит на 25% дешевле.
Как это работает:
• если провайдер подтвердил Cache Hit, скидка применяется автоматически;
• промокоды и дополнительные настройки не нужны;
• обычные входные и выходные токены тарифицируются как прежде;
• скидка применяется только к закэшированным входным токенам, а не ко всему запросу.
Примеры:
•
gpt-5.5: $0.08 → $0.06 за 1M cached tokens•
gpt-5.6-terra: $0.07 → $0.0525 за 1M cached tokensЧем чаще в запросах повторяется большой системный промпт или контекст, тем заметнее экономия 💙