Разрабы ИИ-агента Hermes сэкономили $1,8 млн на рефакторинге кодовой базы 1 393 субагента, а вся координация жила в одном Python-процессе на домашнем i7 с 64 ГБ памяти.
Основной прогон занял около 19 часов. Через 50 минут всё легло из-за протухшего токена провайдера. Текниум запустил отдельную сессию Hermes, разобрал с ней причину, подготовил передачу контекста и возобновил работу. Коммиты воркеров сохранились, поэтому армия продолжила не с нуля.
Что получилось:
• код на Python: 1 063 826 → 698 363 строк, минус 34,4%
• файлов больше 5 000 строк: 37 → 6
• функций длиннее 300 строк: 192 → 2
•
gateway/run.py: 34 847 → 5 512 строкПравда на API ушло примерно $25 000. Но если пересчитать в живые часы на человека, то оценка работы достигла $1,8 млн и до двух лет работы. Более того, из этих прогонов выросли 14 исправлений самого Hermes. То есть агент не просто отрефакторил себя, но ещё и устроил нагрузочный тест собственной нервной системе.
Ещё один хороший эффект: после рефакторинга средний поиск определения функции стал стоить агенту 993 токена вместо 2 218. Код оказался удобнее читать не только людям, но и самим моделям. Ревью нашло настоящие регрессии, которые тесты пропустили: воркеры удаляли публичные функции внешних плагинов и меняли обработку исключений. PR смержили только после двух раундов правок сообщества.
Вот поэтому история мне и нравится. Не демка на 20 файлах и не вайб-кодинг за вечер, а миллион строк, 19 часов хаоса, $25 000, реальные поломки, человеческое ревью и в итоге кодовая база на треть меньше.
Как думаете, через год такое вообще будет кого-то удивлять?
