🤟 Всім салют.
Багато хто вже щодня юзає АІ по роботі, але мало хто аналізує, куди діваються токени і відповідно гроші.
Наш кейс: щодня прогоняємо через модель, умовно одну й туж саму рутину роботу.
Кожен запит — системна інструкція (може бути й твій claude. md / skills/ rules) 3000 токенів + сам промпт 5000.
У відповідь ~700 токенів розбору.
❓ Що таке токен і як llm працює з запитами?
Модель не бачить букв. Текст ріжеться на токени — найменші одиниці, якими вона оперує. Токен може бути словом, частиною слова, символом або байтом.
Офіційна прикидка з глосарію: один токен ≈ 3.5 символи англійського тексту, для інших мов цифра інша і Anthropic її не публікує.
💡 Наша інструкція на 3000 токенів — це ~10500 символів англійською. Українською на той самий текст піде більше, тому прикидати по символах не варто.
❓Скільки це в грошах?
За мільйон токенів:
Opus 5 — $5 вхідні / $25 вихідні, контекст 1M
Sonnet 5 — $2 / $10, контекст 1M
Haiku 4.5 — $1 / $5, контекст 200K
⚠️ Вихідні скрізь рівно в 5 разів дорожчі за вхідні.
Рахуємо наш кейс на Sonnet 5:
вхідні: 50 × 8000 = 400000 токенів → $0.80
вихідні: 50 × 2700 = 135000 токенів → $1.35
разом $2.15 на день, ~$45 на місяць ( при умові 21 робочий день)
Дивимось що вийшло: вихідних токенів утричі менше, а коштують вони більше.
Та сама робота на інших моделях: Haiku 4.5 — $22/міс, Sonnet 5 — $45, Opus 5 — $113.
⚠️ Звідки взялись 2700 вихідних
Відповідь була 700 токенів. Решта 2000 — це міркування: якщо модель думає перед відповіддю, роздуми білляться як output і з'їдають max_tokens. Мінімальний блок — 1024 токени.
Глибину задає
effort: low, medium, high, xhigh, max. Дефолт — high.Скинули effort до low, міркування впали до ~300 токенів. Вихідні: 50 × 1000 = 50000 → $0.50 замість $1.35. День став $1.30 замість $2.15. Мінус 40% рахунку на одному параметрі.
✏️ Скріншоти
Картинка ріжеться на патчі 28×28 пікселів, кожен патч — токен:
⌈ширина / 28⌉ × ⌈висота / 28⌉
Opus 5 і Sonnet 5 тягнуть довгу сторону до 2576 px і до 4784 токенів на картинку. Haiku 4.5 — до 1568 px і 1568 токенів.
Ось для прикладу, я брав скрін з айфона, 1179×2556 → 43 × 92 = 3956 токенів. Тобто одна картинка важить майже як увесь наш лог на 5000. Сотня скрінів на день — $0.79 на Sonnet 5.
Стиснули вдвічі, до 590×1278 → 22 × 46 = 1012 токенів. У чотири рази дешевше, а баг на скріні видно так само.
⌛️ Описи tools
Схема інструментів іде в кожен запит, не один раз.
У доці Anthropic є приклад: один простий інструмент (погода) плюс коротке питання = 403 вхідні токени. Якщо в тебе набір на 2000 токенів і 50 запитів на день — це $4 на місяць тільки за те, що модель читає описи. Скільки саме в тебе — дивись нижче.
❓ Як це все порахувати?
Ендпоінт count_tokens: безкоштовний, зі своїми лімітами ( 5000 запитів на хвилину на старті), рахує все разом — system prompt, повідомлення, описи tools, картинки, PDF і блоки міркувань.
https://platform.claude.com/docs/en/api/cli/messages/count_tokens - тут описано, як це зробити.
відповідь
{ "input_tokens": 2095 }
Далі просто: 2095 ÷ 1 000 000 × $2 = $0.0042 за запит. Множимо на кількість прогонів — маємо реальний бюджет.
Проженемо двічі — зі скріном і без, з --tool і без. Одразу побачимо, що саме жере токени і відповідно гроші.
❓ Як платити менше?
Batch — мінус 50% на все, дедлайн 24 години. Наші $45 стають $22.
Кеш — читання 10% від ціни input. Мінімальний блок: Opus 5 — 512 токенів, Sonnet 5 — 1024, Haiku 4.5 — 4096. Працює на щільних пачках, бо живе 5 хвилин.
Модель під задачу — форматувати JSON на Opus це забивати цвях мікроскопом.
Разом батч + кеш + low effort перетворюють наші $113 на Opus у пару доларів на Haiku. Але також треба вірно визначати модель під конкретну задачу і effort/
Масон QA | Тестувальник ПЗ