ИИ-агенты уже умеют многое. Но чем дольше ими пользуешься, тем сильнее понимаешь: сильной модели мало, если сам агент неудобный
И я сейчас не про спор, какая модель умнее.
Я про более практичные вещи:
• можно ли нормально разделять контексты;
• видно ли, какой моделью работает агент;
• понятно ли, когда включился fallback (автоматическое переключение на запасную модель);
• ясно ли, что делает субагент;
• не превращается ли диалог с ботом в одну длинную кашу.
Последнее время я смотрел на это не только как пользователь, но и как человек, который может предлагать изменения в коде проектов с открытым кодом.
Речь про Hermes и OpenClaw - софт для работы с ИИ-агентами.
Начну с Hermes.
Одна из самых полезных идей, которую я туда предложил, - темы в личке Telegram-бота.
Когда у тебя один чат с агентом, туда быстро сваливается всё подряд: код, контент, эксперименты, тесты. И через время это больше похоже не на рабочий диалог, а на кладовку.
Контекст смешивается, и пользоваться ботом становится тяжелее.
Если же есть темы, всё уже выглядит намного чище:
• одна тема под один проект;
• другая под другой;
• третья под отдельный режим или навык.
Бот остаётся один, но внутри появляется нормальная структура.
Для обычного пользователя это вполне практическое улучшение:
меньше путаницы, проще держать фокус, легче возвращаться к нужной задаче.
Это для меня один из самых удачных кейсов за последнее время:
мою реализацию тем в личке забрали в основной репозиторий с сохранением авторства. Итоговый PR: https://github.com/NousResearch/hermes-agent/pull/3163
Ещё в Hermes я предлагал такие UX-улучшения:
• подпись к voice-сообщению вместо отдельного текста;
• отображение модели у субагента;
• отдельную модель для отдельной темы;
• уведомления о fallback.
Но они пока не приняты.
Когда агентом пользуешься каждый день, такие вещи быстро перестают казаться мелочами.
Теперь про OpenClaw.
Там мне не хватало другой вещи - прозрачности.
Если запускается субагент, это лучше явно показывать пользователю.
Если система тихо переключилась на fallback-модель, это тоже лучше не прятать.
Иначе работать становится очень неудобно. Пишешь код или что-то обсуждаешь, а потом в какой-то момент понимаешь: ответы резко стали хуже. И пользователь узнаёт о переключении не из интерфейса, а по симптомам.
Наиболее сильно мне запомнился случай, когда я делал правки в OpenClaw с ChatGPT, но у него закончились лимиты. В результате произошло тихое переключение на Minimax. А она программировать нормально не умеет. После чего начинается отдельный квест: понять, что она там насобирала 🙂.
Итог - синтаксическая ошибка, из-за которой приложение перестало запускаться. Пришлось разбираться вручную.
Поэтому я считаю важным, чтобы агент явно сообщал о переходе на fallback-модель и показывал, какая модель выбрана для субагента.
Но эти предложения пока не вошли в основной репозиторий.
Итог:
ИИ действительно сильно ускоряет такую работу.
С ним проще собрать черновик, быстрее проверить гипотезу и быстрее дойти до рабочего варианта.
Но в деталях он всё ещё часто ошибается.
Особенно неприятно, когда в процессе незаметно включается fallback на более слабую модель.
Тогда хорошая идея легко превращается в сырой PR, который потом всё равно приходится допиливать вручную.
Мне интересно не просто писать код или отправлять pull request'ы ради галочки.
Гораздо интереснее улучшать реальный опыт работы с ИИ-агентами:
чтобы ими было удобнее пользоваться,
чтобы было меньше скрытой магии,
чтобы было больше прозрачности.
Потому что сами модели уже часто сильные.
А вот UX (удобство использования) местами всё ещё сырой.
И именно такие вещи часто решают, будешь ли ты реально пользоваться таким агентом каждый день или просто иногда запускать его как игрушку.
А вам в ИИ-агентах чего не хватает больше всего:
прозрачности, управления или просто удобства?
😎 Незрячий web3 программист (подписаться)
Чат | бот
Post #1620
552
- 👍 13
- 🔥 7
- ❤ 4