Меня постоянно спрашивают про Hermes Agent (опенсорсный агент типа OpenClaw) - зачем он нужен.
Собрал ответы на самые частые вопросы в один пост.
Чем это лучше Codex или клод кода, запущенного в терминале и подключённого к телеграму?
Ничем. Это буквально оно и есть - claude code / codex на сервере или ноуте, плюс небольшие фичи для постоянной работы: чуть иначе организованная память, работа с проектами, кроны.
Чем это лучше приложения ChatGPT / Claude с подключёнными коннекторами?
Коннекторы там сделаны через жопу, и живут в разных мирах (подозреваю дело не в том что в OpenAI плохие инженеры, а в том что приложение проектировали когда агентов не существовало, а модели не могли внятно ответить на один вопрос). Попробуйте сказать ChatGPT: найди в Gmail последнее письмо где я отправлял PDF, скачай файл, переведи на китайский, собери обратно в PDF и отправь тому же адресату. Есть коннектор к Gmail, есть встроенная файловая система, есть python - а задача не решается, потому что Gmail-коннектор не может положить файл туда, где живёт python. У Claude с этим получше, но до идеала далеко. У агента всё это один линукс.
Второе - в приложениях нет проактивных действий. Всё триггерится моим сообщением: я пишу - модель отвечает. А хочется наоборот - чтобы модель писала мне, когда что-то произошло. Вы скажете - у ChatGPT же есть кроны. Кроны это другое. Вот мой пример: на каждый релиз Claude Code взять changelog, скачать бинарник, отреверсить и написать мне только если внутри есть фичи которых в changelog нет - спрятанные за фича-флагами, иначе молчать. Так я узнаю что антропики готовят, до анонса. Это не «каждый день в 9 утра сводка новостей», это пиши если что то случилось.
Третье - persistent deployment. У меня рядом с агентом 24/7 крутится сервис который сливает выбранные телеграм-чаты в sqlite базу, вообще без LLM. Агент по крону читает базу, занимается тренд-вотчингом и приносит саммари - если все начали обсуждать что-то новое, я узнаю первым, не читая тысячи сообщений. Сервисы легко стыкуются: один пишет в файл, другой читает. В ChatGPT пришлось бы городить свой MCP и микросервисы ради базовой задачи. Тут я сказал агенту что нужно - он написал, запустил у себя, моей когнитивной активности потребовалось ноль.
Это же супердорого - нужен Mac mini и куча токенов?
Сервер за $12 в месяц, хватает полностью. До этого крутил на ноутбуке, но отказался - ноут выключен ровно тогда, когда надо что-то с телефона. Токены из той же подписки Codex что и приложение, доплачиваю ровно ноль.
P.S. ChatGPT сегодня обещает большой редизайн приложения и прокачку агентского режима. Очень жду - возможно они учтут успех таких агентов и притащат хотя бы часть фичей к себе. Потому что у формата с телеграмом есть свои минусы: чат один, и пока агент что-то ресёрчит, вторую задачу в параллель ему не дать. Плюс на сетап всё равно уходит время. Если они сделают то же самое за подписку и без сетапа — перееду.
Сразу, как канал наберёт 3 000 подписчиков, опубликую вторую часть, в которой расскажу про свои юс-кейсы агента и то, как я его засетапил так, чтобы он реально сильно экономил моё время.
Post #308
1.9K
- ❤ 35
- 👍 12
- 🔥 7