Если тебе нужно чуть больше, чем просто чат с агентом в репо, стоит смотреть в сторону
harnessAnthropic'и сами про это
говорят 🚶:
“We've previously shown that harness design has a substantial impact on the effectiveness of long running agentic coding.”
Что такое
harness по-простому:
это не сама модель, а
обвязка вокруг нее —
как агент держит контекст, переносит state, бережет контекст, режет длинные задачи, проверяет себя, ходит по циклам имплементации и живет дольше одного чата.
Кароч, комбайн, который вместо тебя делает теже действия, когда ты жмешь
Yes, don't ask me more 👊
Обычный чат, даже с хорошим
AGENTS.md может
:• терять нить на длинных задачах
• засираться контекстом и жечь твои cached-tokens
• плохо проверять сам себя
• сыпаться на multi-step / multi-repo работе
Конечно, криво сделанный
harness — сожжет еще больше токенов почем зря. Как нибудь расскажу, как я напалил
5k$ 🔫 в компании и какие тупые ошибки по незнанке сделал сначала.
Примеры
harness:
•
OpenClaw — поиграйся, уже хайп спал и можно спокойно развернуть без FOMO потыкать.
•
ECC — Это уже скорее про работу, потыкай это мощный harness именно нацеленный закрывать задачи.
Суть:
модель — это мотор, harness — это вся остальная машина.
И похоже, сами Anthropic и OpenAI
тоже топят именно за это. Единственная проблема, пока вендоры не могут сделать тулзу, которая закроет ваши потребности, из-за зоопарка стека, тулинга и окружения. Поэтому есть окно возможности, запилить свою поделку 😨