🧠 Три независимых изменения за один месяц — вот откуда шли жалобы на Claude Code
Anthropic разобрались, что именно сломалось. Оказалось не один баг и не деградация модели, а три несвязанных изменения с разными датами, каждое из которых прошло через все тесты и code review.
1️⃣ 4 марта reasoning effort по умолчанию сменили с high на medium, чтобы убрать зависание UI при тяжёлых задачах. Claude заметно поглупел. Откатили 7 апреля. Сейчас для Opus 4.7 стоит xhigh, для остальных моделей high.
2️⃣ 26 марта добавили оптимизацию кэша. Если сессия простаивала больше часа, старый reasoning должен был сброситься один раз для экономии токенов. Баг сделал сброс на каждом ходу до конца сессии. Claude продолжал работать, но без памяти зачем вообще делал предыдущие шаги. Отсюда повторы, странные вызовы инструментов, забывчивость. Починили 10 апреля.
3️⃣ 16 апреля в системный промпт добавили лимит на длину — не больше 25 слов между tool calls и не больше 100 слов в финальном ответе. В сочетании с другими промпт-изменениями это дало падение качества кода на 3% в метриках. Откатили 20 апреля.
Второй баг вообще не воспроизводился внутри: параллельный эксперимент с отображением thinking скрывал его в большинстве CLI-сессий. Прошёл code review, unit-тесты и e2e-тесты без замечаний.
Я замечал странности в Claude Code в марте и апреле, но списывал на свои ошибки. Теперь понятно что это было - накопленный эффект трёх независимых изменений одновременно. Именно так и устроены самые неприятные баги: каждое изменение по отдельности выглядит нормально, а в сумме дают что-то, что не ловится никакими тестами.
#ClaudeCode #AI
Post #89
2.26K

- 👎 8
- 👍 2