CLAUDE СБРОСИЛ 80% БАЛЛАСТА. И Я ПОШЁЛ ВЗВЕШИВАТЬ СВОЙ HERMES
В конце июля Anthropic опубликовала статью о том, как переделала контекст для новых моделей Claude.
Из системного промпта Claude Code для Opus 5 и Fable 5 убрали больше 80% текста. На внутренних тестах по программированию качество не просело.
До этого Claude отправляли в каждую задачу как человека в кругосветку. В рюкзак складывали всё сразу: правила для работы с кодом, проверки, редкие случаи, инструкции на случай инструкций. Неважно, предстояло ему чинить большой проект или поправить одну строку.
Anthropic разобрала этот рюкзак. Внутри оставила то, что нужно постоянно. Узкие инструкции разложила по skills: понадобился навык — Claude достал его с полки.
Меня это зацепило, потому что мой Hermes месяцами собирался так же как и системный промт Клода до этой утряски.
Новая задача приносила новый skill. Новый риск — новое правило. Новый инструмент — ещё одну инструкцию. Каждый предмет был полезным, но никто давно не взвешивал весь рюкзак целиком.
Мы решили взвесить.
Около 75 тысяч знаков занимал системный промпт. Ещё 51 тысячу добавляли описания инструментов. Получалось примерно 126 килобайт текста, который Hermes читал ещё до моего первого вопроса.
Самым тяжёлым предметом оказалась не память. Каталог skills занимал 68% системного промпта. Сотни навыков заранее рассказывали о себе, хотя в конкретной задаче обычно нужны один-два.
Сначала мы вынесли полные инструкции на полку, а в постоянном контексте оставили короткий список. Сам каталог похудел больше чем вдвое. Но весь рюкзак стал легче только на 23%.
Мы заранее договорились убрать хотя бы четверть и не выбрасывать ни одного навыка, инструмента или правила безопасности. Поэтому 23% оставили на весах и пошли разбирать дальше.
На второй итерации нашли повторы, сдвоенные правила и слишком длинные базовые инструкции. Постоянный контекст уменьшился со 131 до 95 килобайт. Минус 27%.
Красивую цифру получили. Оставалось проверить, не выложили ли мы вместе с 7 шортами и 12 футболками ту самую аптечку.
Старой и новой версиям дали одинаковые задания. Потом отправили решение на независимые проверки. Там нашли вещи, которые обычные весы не показывают.
Отчёт мог случайно перезаписать конфиг. Один запрос к модели не попадал в счётчик. У Codex оставался отдельный путь к инструментам. Даже при выключенном сохранении истории на диске появлялся снимок сессии.
Мы закрыли эти дыры и повторили проверку. Обе версии справились с заданиями. Список skills и инструментов не изменился. Лишних действий не было. Рабочий профиль Hermes мы не трогали.
После этого встроили проверку в публичный server-doctor, этот скил доступен нашим участникам Среды и даёт возможность применить такие фиксы одной командой. Следующую попытку облегчить контекст теперь можно прогнать тем же способом и сравнить с предыдущей.
Anthropic сбросила больше 80%. Мы сняли 27%. Это разные модели и разные системы, поэтому чужая цифра не была нашей целью.
Теперь Hermes не носит склад на спине. Он знает, где всё лежит, и берёт нужное по дороге.
А каждая новая инструкция сначала доказывает, что ей действительно место в рюкзаке.
🧠🚀✅🐾💬
Среда внедрения ИИ:
Внедрить | YouTube
Post #438
578

- 🔥 8
- ❤ 4