TGViewer
TechLead Stream | Иван Поддубный TechLead Stream | Иван Поддубный @techlead_stream · 829 subscribers
Post #168 499

Forwarded from AI for Devs

🔥 Prompt Caching: токены LLM в 10 раз дешевле — но за счёт чего?

Подготовили перевод просто пушечной статьи про кэширование промтов. Внутри много теоретической базы изложенной простыми словами, с классными примерами и наглядными анимациями (без математики тоже не обошлось 🫠).

Вот как сам автор описал свою статью и мы с ним полностью согласны:

Не удовлетворившись ответами в документации вендоров ПО для разработчиков, которые хорошо объясняют, как пользоваться кэшированием промптов, но аккуратно обходят вопрос о том, что именно кэшируется, я решил копнуть глубже.

Я нырнул в кроличью нору устройства LLM, пока не понял, какие именно данные провайдеры кэшируют, для чего они используются и как это делает всё быстрее и дешевле для всех.

К концу этой статьи вы:

– глубже поймёте, как работают LLM
– сформируете новую интуицию о том, почему LLM устроены именно так
– разберётесь, какие именно нули и единицы кэшируются и как это снижает стоимость ваших запросов к LLM


📚 Читайте и комментируйте на Хабр.

@ai_for_devs
  • 👍 3
  • 🔥 3
  • ❤ 1
More from @techlead_stream
  1. Sep 14, 2026Согласен с постом, но хочу докинуть своего мнения) Наибольших результатов в агентской разр…
  2. Sep 12, 2026Интересные скилы для визуализации архитектуры. 1. https://github.com/tt-a1i/archify 2. htt…
  3. Sep 12, 2026Я вечером со своими агентами =)
  4. Sep 6, 2026Post #239
  5. Sep 3, 2026Post #238
  6. Sep 2, 2026Как используют клод при производстве деталей) Выводы в конце содержат флешбеки к ит =) htt…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →