Причина простая: инженеры выпускают примерно в 8 раз больше кода, около 80% которого пишет Claude, а количество тестов в кодовой базе выросло в 10 раз.
Старый test-selection сервис начал захлёбываться. Anthropic прошла три стадии:
больше CPU → sharding → ежедневные рестартыПервая мера продержалась 70 дней, вторая — 29 дней, третья — меньше суток.
В итоге архитектуру переделали полностью: listener стал stateless, результаты CI складываются в общий журнал в in-memory store, а отдельный consumer агрегирует историю тестов. Это позволило горизонтально масштабировать обработку.
Новая система была собрана одним инженером примерно за 3 недели. По оценке Anthropic, год назад такая переделка заняла бы около квартала.
Главный совет команды на эпоху coding agents: проектируйте CI сразу под нагрузку в 10–25 раз выше текущей.
https://claude.com/blog/agentic-coding-is-straining-ci-heres-how-we-scaled-test-impact-analysis-at-anthropic
