В моем IWE сейчас тестируется мультиагентный режим, когда есть несколько агентов, которые исполняют разные роли. Например, я спросил Claude, исполняющего роль разработчика: "А почему верификатор работает лучше уже второй раз? Ведь у него и модель хуже?".
Вот кратко его ответ:
"Почему верификатор точнее — три причины:
- Context isolation. Он видит только результат, не процесс рассуждения. Я, придумав подход B, уже «влюбился» в него — confirmation bias. Верификатор свободен от этого.
- Узкая задача. Я параллельно держу в голове: протоколы, WP-149, код бота, SOP Портного, dt_sync... Верификатор получил одну задачу: «проверь таблицу ЭМОГССБ». Меньше контекста = точнее оценка.
- Модель тут не главное. Haiku хватает для структурированной проверки по чеклисту. АрхГейт — это 7 вопросов с критериями. Не нужен Opus чтобы сверить оценку 9 с фактом «SOTA.011 говорит о knowledge coupling».
Post #654
642
- 👍 3