Мой ИИ-ассистент сегодня научился экономить сам себя.
Обычно все гоняют одну самую мощную (и дорогую) модель на всё подряд — как забивать гвозди микроскопом. Я сделал иначе, тремя уровнями:
1. Общаюсь с ним в средней модели — она почти не упирается в лимиты. Но дал ей право самой взять дорогую, когда задача реально сложная — для этого есть чёткая спека «когда повышать калибр».
2. Рутину — перелопатить память по всем проектам, прочитать десятки файлов — отдаёт дешёвой модели, она ищет бесплатно.
3. А самые сложные и большие задачи — например, написать спеку на продукт — ассистент научился отдавать из Claude Code в Codex (тяжеловес под код и большие документы).
Результат за день (скрин лимитов):
— недельный лимит всех моделей — 26%
— самая премиальная модель почти остановилась (33% и не растёт)
— пятичасовой лимит горит в разы медленнее
Это называется model routing — маршрутизируешь задачу на модель под её класс, а не «всё одним большим мозгом». Дорогой ум — только там, где он реально нужен.
Так система из «жрёт лимиты за час» превращается в «работает весь день и не устаёт». Ровно то, чему я учу: ИИ-систему надо не просто включить, а спроектировать экономной.
Кому нужен подробный разбор со схемой и спекой «когда какая модель» — поставьте «+» в комментариях, пришлю HTML. Заодно пойму, скольким это сейчас надо.
Post #6541
257

- 🐳 2