🤖 Кто нашёл больше багов AI-агент или человек?
Я бы поставил на человека и не списывал со счетов.
За 11 недель работы с AI-тестировщиком:
🐛 AI-агент - 77 подтверждённых находок
👨💻 Человек - только 16
⏱️ Агент отработал 277 часов, человек 213
На первый взгляд разгром.
Но дальше начинается самое интересное.
Агент оказался очень хорош в систематическом переборе состояний, сверке с ТЗ и макетами, анализе API и заглядывании под капот. При этом человек находил то, что агенту пока сложно заметить: визуальные проблемы, неожиданные регрессии и дефекты, которые обнаруживаются только при живом исследовании продукта.
А ещё выяснилось, что примерно 130 кандидатов агента не пережили проверку, а промежуточный подсчёт находок однажды оказался завышен почти вдвое.
То есть вопрос оказался не в том, «кто лучше тестирует, человек или AI?»
Гораздо интереснее:
👉 где агент действительно эффективнее человека?
👉 какие задачи дают ему максимальную отдачу?
👉 сколько на самом деле стоит AI-тестировщик?
👉 какие баги он пропускает?
👉 и можно ли вообще считать его заменой QA?
В статье приведены замеры за 11 недель, методика подсчёта, экономика, примеры найденных и пропущенных дефектов и выводы о том, где AI действительно приносит пользу QA.
Читайте на Хабре 👇
#QA #AI #AIAgents #Тестирование #Automation #ClaudeCode
Post #1175
365

- 🔥 4
- 👍 2
- 🤔 2
- ❤ 1