> медианный объём «thinking» снизился примерно с ~2 200 до ~600 символов
> количество API-запросов выросло в 80 раз с февраля по март — меньше «размышлений» и больше неудачных попыток → больше ретраев, больше расход токенов и затрат
> reads-per-edit упал с 6.6× до 2.0× — модель меньше изучает код перед внесением изменений
> модель пыталась соскочить или спрашивала «продолжать?» 173 раза за 17 дней (до 8 марта — 0 раз)
> самопротиворечия в рассуждениях («ой, подожди, на самом деле…») утроились
> соглашения вроде CLAUDE.md игнорируются, потому что не хватает «бюджета мышления» на перекрёстную проверку правок
> худшее время — 17:00 и 19:00 по PST, поздняя ночь значительно лучше — это указывает на то, что выделение «thinking» зависит от загрузки GPU
Борис подробно ответил на это в issue — в основном дело в том, что они перестали показывать саммари «thinking» ради снижения задержки (это можно включить обратно через opt-in), и именно это повлияло на измерение «thinking». 😁
