Anthropic'и сами про это говорят 🚶:
“We've previously shown that harness design has a substantial impact on the effectiveness of long running agentic coding.”
Что такое harness по-простому:
это не сама модель, а обвязка вокруг нее —
как агент держит контекст, переносит state, бережет контекст, режет длинные задачи, проверяет себя, ходит по циклам имплементации и живет дольше одного чата.
Кароч, комбайн, который вместо тебя делает теже действия, когда ты жмешь
Yes, don't ask me more 👊Обычный чат, даже с хорошим AGENTS.md может:
• терять нить на длинных задачах
• засираться контекстом и жечь твои cached-tokens
• плохо проверять сам себя
• сыпаться на multi-step / multi-repo работе
Конечно, криво сделанный harness — сожжет еще больше токенов почем зря. Как нибудь расскажу, как я напалил 5k$ 🔫 в компании и какие тупые ошибки по незнанке сделал сначала.
Примеры harness:
• OpenClaw — поиграйся, уже хайп спал и можно спокойно развернуть без FOMO потыкать.
• ECC — Это уже скорее про работу, потыкай это мощный harness именно нацеленный закрывать задачи.
Суть:
модель — это мотор, harness — это вся остальная машина.
И похоже, сами Anthropic и OpenAI тоже топят именно за это. Единственная проблема, пока вендоры не могут сделать тулзу, которая закроет ваши потребности, из-за зоопарка стека, тулинга и окружения. Поэтому есть окно возможности, запилить свою поделку 😨