В процессе заметил парочку жирных нюансов, которые сейчас спасают при работе с платной подпиской Claude (особенно с их новой Opus 5). Если их использовать - всё будет чики-пуки и токены не улетят в трубу. Anthropic как раз выкатили гайд о том, как не дать модели сжигать лимиты. Ага, только я это понял уже на своём опыте😒
Суть в том, что новую нейронку нужно не заставлять работать, а вовремя останавливать. Она так любит перепроверять себя, подключать субагентов и улучшать то, что не просили, что старые промпты в духе "внимательно подумай" теперь тупо жрут весь балик.
Вот как нужно с ней общаться сейчас, чтобы кодить быстро и без переплат:
Грузите задачу целиком. Opus 5 лучше работает, когда сразу видит конечный результат, ограничения и критерии готовности. Описали всё подробно один раз - и оставили её работать, она реже стопается посередине.
Жестко задавайте объем ответа. Если нужен конкретный кусок кода или ответ без диссертации на три экрана, пишите прямо: "Сначала покажи результат. Затем кратко перечисли ключевые решения". Параметр effort не гарантирует короткий текст.
Описывайте нужное поведение, а не запреты. Вместо кучи "НЕ делай то, НЕ делай это", задайте формат: "Перед началом дай одно короткое предложение. Во время работы сообщай только о важных находках. В конце начни с готового результата".
Ограничивайте масштаб. Нейронка может решить, что вместе с фиксом одной кнопки неплохо бы переписать половину проекта. Фиксируем границы: "Работай только в указанном объёме. Не расширяй задачу без необходимости".
Уберите просьбы всё перепроверять. Opus 5 уже сама ищет ошибки. Фразы вроде "проведи финальную проверку" или "попроси другого агента проверить" запускают лишние циклы, увеличивая время и прайс.
Не выпускайте армию субагентов. Модель стала слишком охотно делегировать задачи. Для фикса мелочей это бессмысленно и дорого. Добавляйте: "Используй субагентов только для крупных кусков работы, мелкие задачи выполняй сам". (При этом функцию thinking отключать не стоит, просто регулируйте ее через effort).
Универсальный шаблон промпта:
Результат: [Что нужно получить]
Контекст и файлы: [С чем должна работать модель]
Ограничения: [Что нельзя менять и куда нельзя выходить]
Готово, когда: [Проверяемые критерии результата]
Работай только в указанном объёме. Обычные решения принимай самостоятельно. Задавай вопрос, только если выбор существенно изменит результат. Субагентов используй только для крупных независимых частей. Сначала покажи готовый результат, затем кратко перечисли ключевые решения и риски.
Промптинг реально превращается из искусства "заставь модель думать" в искусство "не дай ей превратить мелкую задачу в двухдневный проект".
Что думаете про это❓