С сентября я ввожу в своей команде довольно жёсткое правило: каждую задачу сначала отдаём автономному агенту. Он сам берёт тикет, разбирается и открывает пул-реквест. По дороге мы ему не помогаем.
Мне хочется, чтобы мы наконец занялись тем, что и раньше называли хорошей инженерией, но часто оставляли на совести конкретного разработчика.
Единые правила для API, хорошие спецификации, архитектурные ограничения, тесты. Всё это было нужно всегда. Но в живой системе знания неизбежно распределены: что-то записано в ADR, что-то видно из соседнего кода, а что-то проще спросить у коллеги. Опытный инженер умеет собрать этот контекст и принять разумное решение. Обычно этого хватало, поэтому не было большого стимула формализовать вообще всё.
У агента нет такого фонового знания, да и доверяем мы ему пока меньше. Поэтому любые неоднозначности проявляются быстрее. Где-то терминология менялась со временем, где-то соседние части системы развивались немного по-разному, где-то архитектурное решение хорошо описано, но ничем автоматически не проверяется. Само по себе это нормально. Агент просто заставляет договориться, какой вариант мы считаем правильным.
Когда он ошибается, очень хочется написать в чат: «Вот здесь вызови другой метод». Текущую задачу агент исправит. Но следующий через неделю может ошибиться там же.
Поэтому я хочу, чтобы мы каждый раз спрашивали: откуда агент должен был узнать правило и чем мог проверить себя? Если ответ «никак», значит, надо улучшить систему. Дописать правило, поправить харнес, сделать тест или линтер. Потом снова отдать агенту ту же задачу и посмотреть, справится ли он без подсказки.
Если не справился, ничего страшного. Инженер закроет задачу руками. Но после такого провала должен остаться экшен-айтем: что именно мы собираемся улучшить, чтобы в следующий раз не объяснять всё заново в чате.
Получается, агенты не принесли новых требований к качеству. Они подняли требования к их явности. То, что опытный инженер раньше восстанавливал из общего контекста, теперь приходится точнее описывать и по возможности проверять автоматически.
Кажется, это полезное изменение и для агентов, и для нас самих.
Post #47
500

- 👍 17
- ❤ 7