Автор месяц работал с Hermes Agent через CLI (WSL) — десктопа под Windows не было. В версии v0.15.2 вышел установщик Desktop APP на Electron для Windows, macOS и Linux.
В GUI 13 разделов. Разберем настройки:
Model. Основная модель —
ollama-cloud/kimi-k2.6. Context Length держу на 0: Hermes сам запрашивает у провайдера актуальный лимит. Захардкоженное число устаревает — Kimi перешёл с 128K на 256K.По умолчанию все auxiliary-задачи стоят на
provider: auto и откатываются на основную модель. Триллион параметров тратится на заголовки и поиск по сессиям. Прописал каждой задаче свою модель:- vision →
qwen3-vl:235b-instruct- web_extract, compression, curator →
kimi-k2.5- skills_hub, approval, mcp, title_gen, session_search →
rnj-1:8bБаг:
session_search нельзя назначить через GUI — список auxiliary-задач зашит в коде Electron, эту задачу не добавили. Лечится через CLI:
hermes config set auxiliary.session_search.provider ollama-cloud
hermes config set auxiliary.session_search.model rnj-1:8b
После перезапуска работает, но UI всё равно показывает
auto.Chat. Personality —
Philosopher. Reasoning Blocks — Off.Appearance. Tool Call Display —
Technical: показывает raw JSON аргументов и результатов вызовов. Нужно для отладки. Не отлаживаете — ставьте Product.Workspace. Главное изменение — Environment Passthrough:
PATH,CUDA_PATH. Без него агент не видел CUDA, приходилось прописывать абсолютные пути к Python, pip, nvidia-smi. Auto-Approve File Writes — Off.Safety. Approval Mode —
Manual: подтверждение перед каждой опасной командой. Approval Timeout поднял с 60 до 120 секунд. Redact Secrets — On: скрывает пароли, ключи и токены из контекста перед отправкой в модель.Memory & Context. Persistent Memory —
On: сохраняет факты между сессиями. Protected Recent Messages поднял с 20 до 30 — эти сообщения не сжимаются.Advanced. Max Agent Steps поднял с 90 до 120 — pipeline автопостинга обрывался на 90. Subagent Model —
rnj-1:8b вместо kimi-k2.6.Gateway. Локальный шлюз на localhost, работает offline. Если уже запущен CLI-шлюз с тем же Telegram-токеном, Desktop отключит его при старте. Нужны разные токены или один шлюз.
Минусы:
1. Electron ест ~400 МБ в простое — в 5 раз больше CLI.
2. Свои темы сделать нельзя.
3. На Linux не standalone: Python-зависимости ставятся вручную.
4. Конфликт шлюзов по одному токену.
5. Редактор конфига базовый.
6. Session Search назначается только через CLI.
Итог: тот же агент, навыки и память, но без терминала. Параллельные чаты окупают переход.
Полная версия статьи: https://habr.com/ru/articles/1044270/
