Я работаю автоматизатором тестирования — пишу автотесты на разный софт, чтобы проверять что он работает как задумано и не ломается, а если ломается, то мы могли быстро это заметить и починить до того как это попадет к пользователям
Чтобы закрывать задачи быстрее, я использую ИИ-агентов. У меня есть одна подписка на Claude за $20 и одна корпоративная на Cursor с лимитом $300 в месяц
Обычно флоу работы по задаче выглядит примерно следующим образом:
1) Разбираешься в задаче — смотришь постановку, уточняешь требования, смотришь что поменялось в коде (бэк/фронт)
2) Определяешь скоуп тестирования — сценарии, граничные случаи, тест-кейсы
3) Проходишь руками по фиче на стенде, ловишь очевидные баги
4) Пишешь автотесты в стиле команды
5) Прогоняешь локально, дебажишь, прогоняешь на стенде
6) Проходишь код-ревью
Значительную часть из этого может делать ваш ИИ-агент
Но если вы просто попросите агента "Сделай мне задачу чтобы все было хорошо и без багов" — он вполне может выдать вам решение, которое будет работать технически, но с точки зрения здравого смысла это будет полным булщитом. ИИ-агенты любят додумывать неопределенные места по-своему)
Чтобы избежать такого, я использую механизм инструкций для агентов — скилл, который читает агент перед тем как начать работать над задачей
Скилл состоит из нескольких шагов, и эти шаги обложены гейтами. Каждый из шагов (требования → уточнения → расположение теста → файл → код → ревью → прогон → дебаг) закрывается явным статусом в чате — что-то вроде "шаг сделан" / "шаг пропущен, потому что..." / "шаг уже был сделан в прошлой сессии". Пока текущий шаг не закрыт — переходить к следующему агенту запрещено
Плюс на некоторых шагах агент обязан уточнять у меня детали, даже если задача расписана максимально подробно. Например, он согласует со мной тест-кейсы, инструменты, другие неявные моменты
Входной точкой с моей стороны служит один промпт "Напиши автотесты по задаче ABOBA-228"
Под капотом агент делает следующее:
1) Подключается по mcp в Jira и Confluence, идет за описанием задачи и требованиями, смотрит подвязанную к задаче документацию
2) Смотрит diff в GitLab что изменилось в коде
3) Уточняет у меня скоуп тестирования, какие сценарии покрываем, различные детали
4) Определяет, куда положить тест, можно ли его дописать в существующий файл вместо нового
5) Пишет тесты по внутренним конвенциям и паттернам команды:
Агент обязан прочитать больше десятка отдельных референс-файлов: какие паттерны кода запрещены, как готовить тестовые данные, как оформлять Page Object'ы, какие фикстуры уже есть и не надо изобретать заново, как параметризовать тесты под разные хосты/бренды/разрешения экрана, как оформлять атрибуты для отчётов Allure — плюс смотрит на готовые примеры похожих тестов в проекте
6) Запускает субагента для ревью
7) Прогоняет тесты локально, дебажит упавшие кейсы по логам и скриншотам
Потом я провожу ревью со своей стороны и поправляю его код
В итоге выполнение задачи занимает сильно меньше времени — остается проверять, что задача выполнена корректно
⭐️⭐️⭐️
Подписывайтесь на канал, буду делиться прикольчиками. Гад блессик вам в это утро среды 🙏
