TGViewer
dev.insuline.eth dev.insuline.eth @insuline_eth · 8.2K subscribers
Post #947 3.62K
GM! Борис Черный, создатель Claude Code, недавно на интервью сказал:

удаляйте все скиллы, удаляйте системные промпты и смотрите на результат. Мы сделали так с Claude Code и не пожалели.


И я его понимаю, потому что с харнессом часто происходит какая-то жесть. Модель не меняется, а обновление Claude Code начинает вести себя по-другому: что-то подкрутили внутренним патчем в харнесе, и твои скиллы, написанные под прошлое поведение, теперь только мешают. По-хорошему это надо ловить тестами на своих задачах: стал хуже, стал лучше, что сломалось. Но кто из нас реально этим занимается? Думаю, шансы околонулевые, если у вас не проект продакшн-уровня.

Раньше я писал скиллы формата «как работать с задачей»: создай ветку, подними worktree вот так, открой PR, напиши title и description по шаблону, запусти codex на ревью. Сейчас это мусор в контексте, модель и так знает, как это делается, и делает лучше, чем я ей описывал.

Так что у себя я снёс системный промпт почти полностью. Осталась таблица сравнения моделей, чтобы правильно спавнить субагентов по параметрам цены / эффективности / скорости / мозгов, и всё. Скиллы тоже почти все удалил, оставил только супер минимальные про мои инструменты: говорю «твиттер», дёргается bird CLI, «телеграм» идёт в tdl, который умеет качать и знает, какой из моих аккаунтов для чего; плюс транскрипт-скилл через локальный whisper. Это не инструкции «как думать», это просто набор моих инструментов, которые модель по умолчанию не знает и путает.

Но под разработку остался один набор, который я установил в апреле и не удаляю: скиллы Matt Pocock.

Устанавливается легко: claude plugins install mattpocock-skills для клод кода или npx skills@latest add mattpocock/skills для всех остальных.

Скиллов там много, не все полезные, некоторые генерят тонны слопа, но штуки четыре мной используются ежедневно уже на протяжении полугода с момента выхода:

/grill-me и /grill-with-docs. Прожарка. Супер универсальный: работает и на посты, и на разработку, и на планирование чего угодно. Задаёт кучу наводящих вопросов, и пока на них отвечаешь, понимаешь, что задачу изначально представлял не так, либо наконец нормально её описываешь: ограничения, корнер-кейсы, что хочешь увидеть на выходе. ТЗ пишется само в процессе.

/handoff. Под конец переписки, когда контекст кончается или просто прыгаешь между агентами. Я никогда не делаю больше двух компактов в одной сессии, после этого контекст превращается в рандомную кашу, из которой непонятно, что откуда взялось. Handoff пишет в markdown всё ключевое, и следующий агент стартует с чистого листа, но полностью в контексте.

/wait-what. Иногда ответы моделей в спеках и планах превращаются в какую-то жесть: читаешь текст и не понимаешь ни слова. Когда я софт под вилки писал, бывало, не понимал, о чём он, даже на русском. То есть это не language barrier, он просто перестаёт говорить по-человечески. Пишешь «wait what», и он объясняет так, чтобы ты понял.

/diagnosing-bugs. Сборка логов, попытка воспроизвести ошибку, тест, фикс. Ровно то, что Борис говорит не нужно, и он скорее прав, но порядок дисциплинирует.

Забавно осознавать, что каждый скилл по сути одна-две строчки. Ценность не в тексте скилла, а в том, что они складываются в workflow: grill, потом implement, wait what, когда перестал понимать, handoff, когда контекст кончился.

Но есть и противоположный полюс. Последние недели в иностранном твиттере и на ютубе форсят pstack, скиллы чувака из React core team, который сейчас в Cursor. И это прям анти-Борис: 25 скиллов, 22 плейбука, один entry point /poteto-mode, который сам решает, по какому плейбуку идти, и разводит работу по моделям: точный код в Sol, механику в Grok, прозу и judgment в Fable. Сам poteto в гайде описывает это так:

pstack работает лучше всего, когда ты перестаёшь микроменеджить агента. Ты описываешь, что хочешь получить и как поймёшь, что это сделано. /poteto-mode сам выбирает плейбук, запускает остальные скиллы по мере того, как они нужны шагам, и показывает тебе доказательства. Если запомнить из гайда одно: дай агенту цель и способ её проверить, своими словами. Не нужно называть плейбук или перечислять скиллы. "Сначала воспроизведи" и проверяемый результат, больше роутеру ничего не надо


Сам не пробовал, но по описанию там есть вещи, которых у Мэтта нет. /interrogate, где несколько разных моделей пытаются сломать твой дифф. /blast-radius, который показывает, что ещё может отвалиться от маленькой правки, с доказательством через прогон кода, а не «я думаю, ничего».

Так кто прав, удаляем все скиллы или собираем 22 плейбука на любую ситуацию, чтобы разруливать скиллами и не промптить самостоятельно?
  • 👍 19
  • 🐳 12
More from @insuline_eth
  1. Sep 18, 2026OpenAI опубликовали обучающий датасет для GPT-6 Astra Computer Use
  2. Sep 16, 2026ахахаха это гениально и больно)))
  3. Sep 16, 2026GM! Хейтеры клода, вы будете очень довольны! https://insulineru.github.io/opusfived/
  4. Sep 15, 2026gm! В июне, в день выхода Fable 5, я писал, что вау-эффекта от моделей больше нет: на бенч…
  5. Sep 13, 2026photo post
  6. Sep 13, 2026Post #967
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →