Post #196
126
😴 Подписок Claude и Codex комбинирования пост:
1. Планирование.
1.1. Основной агент Opus 5.5 high, он делает бриф, исследование, задаёт вопросы и создаёт epics / issues
1.2. Затем план параллельно проверяют 5–9 агентов. У каждой линзы один вопрос:
🟠 Агенты Opus 5.5 high проверяют смысл, обязательные проверки это бизнес-ценность и границы задачи, а интерфейс, риски для прода и покрытие эпика проверяются тогда, когда задача их касается;
🟠 GPT-6-Sol high сверяет с кодом: всегда проверяются контракты и данные, пути доставки, известные классы ошибок + при необходимост права доступа, когда появляются новые таблицы или роли.
Т.е. есть "ядро" из 5 линз + 4 дополнительных + планировщик-оркестратор может при необходимости добавить "кастомную" линзу на проверку конкретной задачи
Все ревьюеры запускаются параллельно.
1.3. Исправление и повторное ревью.
1.4. Если за три раунда план не сошёлся, его переписывает Fable 5.1 и одтаёт в работу.
Когда я внедрил такую систему ревью, планы стали гораздо быстрее доезжать до исполнителя, часто за 1-2 раунда.
2. Реализация.
2.1. Оркестратор на GPT-6-Sol high ведёт несколько задач параллельно, если они не пересекаются.
2.2. Код пишет GPT-6-Sol high либо Opus 5.5 high, в зависимости от типа задачи.
2.3. Сборку, тесты и выход за пределы задачи проверяет GPT-6-Luna high. Ничего не правит.
2.4. Ревью
🔴 GPT-6-Sol high ищет технические дыры: реально ли тесты ловят проблемы, что будет при ошибке, не обходятся ли права доступа и т. д.
🔴 Opus 5.5 high проверяет, совпадает ли реализация с намерением: что было заявлено и что код делает на самом деле, как результат выглядит для пользователя.
2.5. Если хотя бы одна линза нашла проблему, подключается судья на Opus 5.5 xhigh. Он перепроверяет и решает, что чинить сейчас, что вынести в follow up issue, а что отбросить.
2.6. Если за 3 раунда задача не сошлась, её доделывает Astra high.
+ когда на реализации у оркестратора возникают вопросы, требующие решения пользователя, например, gap'ы или нужно продуктовое решение), то он вместо меня эскалирует вопрос на Astra xhigh.
++ есть таблица fallback в несколько ступеней, какие модели использовать вместо каких и на каких этапах, если основные недоступны
1. Планирование.
1.1. Основной агент Opus 5.5 high, он делает бриф, исследование, задаёт вопросы и создаёт epics / issues
1.2. Затем план параллельно проверяют 5–9 агентов. У каждой линзы один вопрос:
🟠 Агенты Opus 5.5 high проверяют смысл, обязательные проверки это бизнес-ценность и границы задачи, а интерфейс, риски для прода и покрытие эпика проверяются тогда, когда задача их касается;
🟠 GPT-6-Sol high сверяет с кодом: всегда проверяются контракты и данные, пути доставки, известные классы ошибок + при необходимост права доступа, когда появляются новые таблицы или роли.
Т.е. есть "ядро" из 5 линз + 4 дополнительных + планировщик-оркестратор может при необходимости добавить "кастомную" линзу на проверку конкретной задачи
Все ревьюеры запускаются параллельно.
1.3. Исправление и повторное ревью.
1.4. Если за три раунда план не сошёлся, его переписывает Fable 5.1 и одтаёт в работу.
Когда я внедрил такую систему ревью, планы стали гораздо быстрее доезжать до исполнителя, часто за 1-2 раунда.
2. Реализация.
2.1. Оркестратор на GPT-6-Sol high ведёт несколько задач параллельно, если они не пересекаются.
2.2. Код пишет GPT-6-Sol high либо Opus 5.5 high, в зависимости от типа задачи.
2.3. Сборку, тесты и выход за пределы задачи проверяет GPT-6-Luna high. Ничего не правит.
2.4. Ревью
🔴 GPT-6-Sol high ищет технические дыры: реально ли тесты ловят проблемы, что будет при ошибке, не обходятся ли права доступа и т. д.
🔴 Opus 5.5 high проверяет, совпадает ли реализация с намерением: что было заявлено и что код делает на самом деле, как результат выглядит для пользователя.
2.5. Если хотя бы одна линза нашла проблему, подключается судья на Opus 5.5 xhigh. Он перепроверяет и решает, что чинить сейчас, что вынести в follow up issue, а что отбросить.
2.6. Если за 3 раунда задача не сошлась, её доделывает Astra high.
+ когда на реализации у оркестратора возникают вопросы, требующие решения пользователя, например, gap'ы или нужно продуктовое решение), то он вместо меня эскалирует вопрос на Astra xhigh.
++ есть таблица fallback в несколько ступеней, какие модели использовать вместо каких и на каких этапах, если основные недоступны
- 👍 8
- ❤ 2







