TGViewer
AI Coder AI Coder @ai_coder_news · 539 subscribers
Post #593 122
🧠 Маршрутизация моделей в Claude Code: неделя на практике

Настроил для Claude Code маршрутизацию моделей по образцу своего Codex-конфига. Неделю на ней прожил — делюсь.

Идея простая: сильнейшая модель прекрасно умеет писать код. Но гораздо полезнее занять её разбором сложной задачи, постановкой и приёмкой результата, а реализацию делегировать.

🎯 Кто чем занимается

Главный тред — координатор. Он читает код и готовит карточку задачи: цель, какие файлы можно менять, инварианты, критерии приёмки и команды проверки.

Дальше раздаёт работу:

🔎 explorer → Haiku
Только поиск по коду.

🛠 worker → Opus
Реализация через TDD.

🧪 verifier → Sonnet
Независимый прогон проверок по чужому diff.

🧠 senior → Opus на high
Деньги, данные, concurrency и сложные эскалации.

👀 reviewer → другая модель
Семантическое ревью. Обязательно другой моделью, чем у автора.

🔒 Главная фича — координатору нельзя писать код

В Codex-версии это было прописано инструкцией. Здесь запрет обеспечивается хуком PreToolUse.

У субагента в JSON хука есть agent_id, у главного треда — нет. Пока лежит маркер .claude/routing.on, хук отклоняет Edit/Write из главного треда и shell-команды, которые распознаёт как записывающие.

Привычное «да тут одну строку, сейчас быстро сам поправлю» упирается в блокировку.

Именно на таких мелочах разделение ролей обычно и заканчивается. Для меня это главная фича.

📌 Что получилось на практике

• Верификатор поймал ошибку в моей постановке, которую я бы сам не заметил. Проверять нужно и то, правильно ли мы вообще поставили задачу.

• Ревьюер на другой модели прогнал дифференциальную проверку на 100 миллионах входов там, где автор ограничился тестами.

Контекст координатора не раздувается. Подробные логи, содержимое файлов и вывод docker остаются у субагентов. Наверх возвращаются результаты и свидетельства проверок.

💸 Что по стоимости

Токенов в сумме стало больше.

Каждый субагент заново читает файлы. Карточка задачи, отчёт, приёмка — дополнительные проходы по одному изменению. Изоляция контекста не бесплатная.

По моим задачам экономия получается за счёт распределения работы: сильнейшая модель занимается постановкой и приёмкой, часть работы уходит моделям подешевле.

• Против одного треда на сильнейшей модели — дешевле.
• Против одного треда на средней — дороже.

Я здесь в первую очередь покупаю изоляцию и независимый взгляд на результат.

🪤 Грабли за неделю

• Bash-обёртка с heredoc съела stdin хука, и тот молча пропускал всё. Проверяйте, что блокировка действительно срабатывает.

• Лимита в 30 ходов проверяющим не хватило на docker-тесты. В моём сценарии 60 — рабочий минимум.

• Эвристика записывающих shell-команд смотрит на слова, а не на пути. Это ограничение нужно учитывать.

📦 Забрать конфиг

Инсталлятор, готовые конфиги, тесты хука и описание процесса — в gist.

Ставится одной командой. Установка идемпотентная, откат — флагом –restore.
  • 👍 4
More from @ai_coder_news
  1. Sep 18, 2026⚡ Собрал смарт-роутинг для Claude Code: тяжёлые задачи — на GLM-4.5+, рутина — на флеш Под…
  2. Sep 16, 2026Я перестал давать Astra писать код. И дело не в том, что она плохо это делает 🙂 Довёл до…
  3. Sep 14, 2026Как я использую OKF в своих проектах? Я запускаю этот промпт и дальше агент читает правила…
  4. Sep 14, 2026🧠 Google OKF vs OpenViking: какую память делать своим агентам? Начал разбираться с Open K…
  5. Sep 9, 2026Оказывается, hidden reasoning у frontier-моделей можно было буквально украсть за два API-в…
  6. Sep 7, 2026Spotify показал, как сократить расход Claude Code примерно на 90% — и идея тут на самом де…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →