Яку модель Claude брати під яку задачу: розбір після релізу Opus 5Anthropic випустила Opus 5, і в лінійці тепер чотири моделі. Питання «а яку з них вмикати» стало плутанішим, ніж було. Розбираю по-простому: що кому доручати, скільки це коштує і де кожна з них ламається.
Одразу дисклеймер: більшість цифр у релізі — це внутрішні бенчмарки Anthropic. Незалежних результатів поки мало. Тому нижче — суміш офіційних даних і практики, а не якесь імперичне знання.
TL;DR:
Sonnet 5 — ваш дефолт на 80-90% роботи.
Opus 5 — коли Sonnet не витягує: складний дебаг, архітектура, фронтенд із претензією на красу.
Haiku 4.5 — дешеві масові задачі й субагенти.
Fable 5 — рідко, для довгих автономних прогонів.
Все. Далі — деталі, чому саме так.
Скільки це коштуєЗа мільйон токенів (вхід / вихід):
Haiku 4.5 — $1 / $5
Sonnet 5 — $3 / $15 (зараз інтро-ціна $2 / $10 до 31 серпня)
Opus 5 — $5 / $25
Fable 5 — $10 / $50
Ключове: Opus 5 коштує рівно стільки ж, скільки попередній Opus 4.8, але суттєво розумніший. Якщо ви раніше уникали Opus через ціну — перерахуйте. Anthropic заявляє, що на їхньому бенчмарку CursorBench Opus 5 виходить у межах 0.5% від результату Fable 5, але вдвічі дешевше на задачу.
І одразу важлива думка: рахуйте не ціну за токен, а вартість завершеної задачі. Дешева модель, яка з третього разу зробила те, що дорога зробила з першого, — не дешева.
Sonnet 5: робочий кіньСюди йде все звичайне:
- код-рев'ю щоденних PR
- рефакторинг одного-двох файлів
- типові багфікси
- написання тестів
- документація, README
- пояснення чужого коду
- самаризація, чернетки листів
Якість — стабільно висока. Це не «економний варіант», це нормальна робоча модель. Більшість людей, які скаржаться на дорогі рахунки, просто женуть усе через Opus без потреби.
Opus 5: коли Sonnet не витягуєЕскалюйте сюди, якщо:
- дебаг складний і треба знайти причину, а не симптом
- рефакторинг зачіпає багато файлів одночасно
- потрібне архітектурне рішення
- це код-рев'ю перед релізом, де ціна пропущеного бага висока
- ви робите фронтенд і вам важливо, щоб він виглядав добре
Останній пункт — головна новина релізу. Партнери раннього доступу відзначають, що Opus 5 перевіряє власну фронтенд-роботу: відкриває сторінку в браузері на десктопній і мобільній ширині, знаходить кнопку, яка з'їхала за екран, і виправляє до того, як віддати результат. Плюс окремо хвалять анімації, 3D і загальну стабільність між прогонами.
Просте правило ескалації: якщо Sonnet двічі поспіль не впорався з якимось типом задач — переносьте цей тип на Opus. Не всю роботу, а конкретний клас задач.
Haiku 4.5: масовка- витяг структурованих даних
- commit-меседжі
- стаби для тестів
- прості пошукові операції всередині проєкту
- механічна генерація компонентів за готовою специфікацією
Haiku приблизно в 15 разів дешевший за Opus. На задачах «знайди файл, прочитай, віддай» різниці у якості ви не помітите.
Де Haiku підводить: генерує код, який виглядає правильно, але має логічні помилки під поверхнею. Погано тримає складні вимоги й задачі, де треба тримати в голові багато файлів. Тобто для UI за чіткою специфікацією — можна, для UI «зроби гарно» — ні.
Fable 5: козирна картаНайпотужніша, але непрактична для щоденного. Жере токени як не в себе — користувачі підписки Max повідомляють, що одна активна сесія з'їдає 10-20% денного ліміту. Плюс у підписках доступ до неї то з'являється, то переходить на кредити.
Беріть, коли задача довга, автономна і ціна провалу висока: велика міграція, нічний агент, генерація фронтенду зі скриншота. І давайте їй одразу повне ТЗ — це асинхронний виконавець, а не співрозмовник.
Три речі, які зекономлять вам грошіПерше. У Claude Code є режим opusplan: Opus думає й будує план, потім автоматично перемикається на Sonnet для написання коду. Отримуєте архітектуру рівня Opus за ціну виконання Sonnet.
Друге. Якщо користуєтесь субагентами — явно прописуйте їм дешеву модель. Багато хто цього не робить, і субагенти успадковують дорогу модель за замовчуванням. Окремо перевірте, чи не стоїть у вас змінна оточення CLAUDE_CODE_SUBAGENT_MODEL — вона перекриває всі налаштування маршрутизації і тихо ганяє все на дорогій моделі.
Третє. Чистіть контекст. Команди /compact і /clear між задачами ріжуть повторне пересилання історії на 30-50%. Постійні речі про проєкт тримайте у файлі
CLAUDE.md — вони кешуються зі знижкою.
Що змінилося в Opus 5, і що може зламатисьЯкщо ви працюєте через API або будуєте автоматизацію — три моменти:
Режим «думання» тепер увімкнений за замовчуванням. Раніше треба було вмикати вручну. Наслідок: перевірте свій параметр max_tokens, бо токени мислення тепер входять до нього.
Вимкнути думання можна тільки на низьких рівнях зусиль. Якщо поставите високий рівень і спробуєте вимкнути — отримаєте помилку 400.
Приберіть зі своїх промптів інструкції на кшталт «в кінці обов'язково перевір роботу» або «використай окремого агента для перевірки». Opus 5 перевіряє себе сам і від таких інструкцій починає перевіряти надмірно, спалюючи токени намарно.
І ще одне, концептуальне. У Opus 5 і Sonnet 5 є параметр effort — рівень зусиль від низького до максимального. Anthropic прямо радить: спочатку крутіть його, і тільки потім думайте про зміну моделі. Sonnet на високому effort часто закриває задачу, під яку ви вже потягнулись до Opus.
Про дизайн і презентації окремоДві тверезі речі, які варто знати заздалегідь.
Перша: без додаткових налаштувань будь-яка модель Claude генерує однаковий візуал — шрифт Inter, фіолетові градієнти, безпечна сітка. Це не проблема моделі, це середнє по датасету. Лікується плагіном frontend-design і власними правилами стилю у
CLAUDE.md. Без цього навіть Opus 5 видасть шаблон.
Друга: презентації Claude робить нативними pptx, які реально редагуються. Але очікування має бути таким — приблизно 85% готовності і кілька годин ручного доведення на серйозний дек. Це сильно прискорює роботу, але не замінює її.
ПідсумокSonnet за замовчуванням. Opus точково там, де він реально потрібен. Haiku на все дешеве й масове. Fable рідко і свідомо.
І найголовніше: не вірте бенчмаркам, вірте своїм задачам. Візьміть п'ять типових завдань зі свого проєкту, прогоніть через різні моделі й подивіться, де реально є різниця. У більшості випадків вона менша, ніж обіцяють лідерборди.