Поліз я з цікавості не в бенчмарки релізу Opus 5, а в технічну документацію. Цікавого досить багато.
Anthropic пише прямо: приберіть інструкції на кшталт «в кінці перевір результат» або «віддай перевірку окремому агенту». Модель тепер робить це самостійно, і від дублювання починає перевіряти надмірно. Ваш старий промпт, який раніше підвищував якість, тепер просто спалює токени.
Друга зміна тихіша, але зачепить більше людей. Режим міркування увімкнений за замовчуванням — раніше його треба було задавати вручну. Практичний наслідок: токени мислення тепер входять у ваш max_tokens. Якщо ліміт стоїть щільно, відповіді почнуть обриватись там, де раніше все вміщалось. Плюс на рівнях xhigh і max вимкнути мислення вже не можна, отримаєте помилку 400.
Звідси загальне правило нової версії: спершу крутіть effort, і лише потім думайте про зміну моделі. Sonnet на високому рівні зусиль часто закриває задачу, під яку ви вже потягнулись до Opus.
Post #1480
1.06K

- 👍 17