TGViewer
Tool Building Ape × Gleb Kalinin Tool Building Ape × Gleb Kalinin @toolusing · 2.15K subscribers
Post #306 287
Особенности агентов (1)

1) Bias towards action — преверженность действиям. Агенты (GPT Agent, Claude Code, Cursor, Windsurf) стремятся как можно быстрее что-то сделать — писать код, пользоваться инструментами вроде поиска. Но в основном — писать код. Их нужно просить этого не делать, в промте лучше эксплицитно указать, какими инструментами не пользоваться. Например, я часто прошу GPT агента создать для меня презентации, при этом в запросе всегда пишу Don’t generate images. Мне не нужно генеративное уродство, а на его создание уходят иногда даже десятки минут, так как GPT щедро генерирует картинку для каждого слайда.

2) Время автономной работы. По моему опыту, claude code работает автономно максимум 10-15 минут, после чего обычно нужно вмешиваться. Это время может быть больше, если максимально чётко прописать сценарии, предупреждая возможные ошибки.

Один из способов предупреждения ошибок — test-driven development. ИИ пишет тесты — в идеале для всего, что можно протестировать, в реальности хотя бы весь бэкэнд, все апи.

В моей долгосрочной ии-разработке, которая уже сильно отличается от вайб-кодинга, я стараюсь покрывать тестами всю базовую фукнциональность — это здорово экономит время и увеличивает автономность агентов, потому что для отлова базовых ошибок у агента есть всё необходимое.

Вы указываете, что перед окончанием задачи агент прогоняет тесты, если ошибки возникают, они тут же исправляются, и цикл повторяется. В таком режиме claude может и час+ проработать.

Точно так же должен работать и аудит безопасности, и UX-тестирование — но это в реальности не совсем возможно, без людей с любым хоть сколько-то сложным интерфейсом никуда.

Время автономной работы агентов увеличивается по экспоненте. Понятно, что его можно увеличить, просто запустив медленный и тяжелый процесс, блокирующий работу (выкачивание какой-нибудь библиотеки, или тренировки какой-нибудь другой сеточки.

Я никогда не запускаю Клод код в режиме --dangerously-skip-permissions — когда Клод перестаёт спрашивать у вас разрешения на что-либо, а просто выполняет всё, что посчитает нужным. Эта опция тоже влияет на время автономной работы.


3) Тенденция выходить из циклов. Если вы не используете для оркестрации работы агентов в цикле другого агента, или инструменты вроде планировщиков, то агент стремится как можно быстрее завершить цикл.

Например, я просил qwen coder и claude code в цикле генерировать картинки с помощью кода на питоне, анализировать их, используя мультимодальный анализ, и перегенировать код, повторяя цикл. Обычно claude code прекращал работу максимум через 5 повторений. Похожим образом вёл себя qwen-coder (через Goose).
Telegram Tool Building Ape × Gleb Kalinin Агент-художник Что будет, если попросить агента генерировать с помощью кода картинки, самому их анализировать и улучшать? Попробовал с goose + qwen-coder и claude code. Qwen ограничивался минимальной цветовой схемой и набором (первые 3 картинки), тогда…
  • ❤ 3
More from @toolusing
  1. Sep 22, 2026В пятницу ходил в Берлине на коммьюнити-встречу OpenAI. Встреча была про Астру, а в личных…
  2. Sep 15, 2026Из лабы по дизайну у меня выросла методология для работы над продуктами и сервисами — Huma…
  3. Jul 15, 2026На следующей неделе запускаю новую лабораторию по работе с ии-дизайном. Впервые делаю лабу…
  4. Jul 14, 2026Вторая программа — cenno (читается как «ченно»). Это простой инструмент, который даёт ваше…
  5. Jul 14, 2026Сразу несколько новостей. Во-первых, я официально стал Apple-разработчиком и запустил 2 Ma…
  6. Apr 20, 2026Собрал тулкит, который превращает сырые генетические данные (23andMe, AncestryDNA, Genotek…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →