Вийшла стаття на DOU: як виміряти рефакторинг AI-агента на кодовій базі у 200 000 рядків.
Піддослідний — Open WebUI: 209 500 рядків TypeScript, Svelte і Python. Один агент, одна сесія, 12 комітів. Промпт вимагав чотирьох речей: рефакторинг за скілом codebase-refactoring, прогнати jscpd, описати результат, задокументувати перебіг. Це була вся інструкція.
Що вийшло:
— health score: 50 (D) → 61 (C)
— 359 однакових реалізацій API-запиту → одна функція apiRequest()
— дублювання в TypeScript: 20,5% → 6,3%
— ~10 000 рядків зникли з кодової бази
Але найцікавіше не цифри. Агент зупинився сам: middleware на 6 388 рядків без інтеграційних тестів він не чіпав, бо далі безпечність змін нічим було підтвердити. Складність лишилась майже на місці — 37 → 38. Шкала, яка може лише зростати, бреше. Тут видно, де метод упирається в межі.
Висновок: «зроби код чистішим» — не інструкція, бо в ній немає міри. Вимірювана ціль плюс перевірка після кожного кроку — і рефакторинг перестає бути суб'єктивним прибиранням.
Повний розбір, таблиця по кожному коміту і як запустити це в себе — у статті: https://dou.ua/forums/topic/62369/?from=slider
Є що заперечити щодо методу — пишіть у коментарі на DOU, це цінніше за лайк.
Post #999
182

- 🔥 5
- ❤ 2
- 👍 2
- 👀 1