TGViewer
Cryptopiy Cryptopiy @cryptopiy_cryptofuture · 739 subscribers
Post #233 354
Anthropic выпустила довольно интересный материал про то, как тратить меньше денег на Claude и при этом не терять в качестве.

И там есть несколько моментов, которые я бы точно учитывал при работе с новыми моделями.

Первое - старые промпты не всегда хорошо работают с новыми моделями.

Со временем в промптах накапливается куча инструкций вроде «обязательно перепроверь ответ», «будь максимально подробным», «сначала распиши свои рассуждения» и т.д.

Для старых моделей это могло быть полезно. А новые воспринимают такие команды слишком буквально и начинают делать лишнюю работу.

Например, просьба быть максимально подробным в тесте Anthropic заставляла Claude делать десятки ненужных поисков.

После того как такие инструкции убрали, в одном из тестов стоимость работы Claude снизилась в среднем на 14,6%, а точность при этом выросла на 5,3%.

Второй момент - максимальный уровень размышлений нужен далеко не всегда.

На одном из тестов перевод Fable 5.1 на максимальный effort увеличил стоимость ещё на 46%, а результат вырос примерно на 0,5 пункта. Причём Anthropic пишет, что такая разница вообще укладывается в погрешность теста.

Есть ещё более интересный пример.

На CursorBench 3.2 новая Fable 5.1 с low effort показала примерно тот же результат, что Fable 5 с high effort, но обошлась примерно в 3 раза дешевле.

То есть иногда выгоднее взять более сильную модель и заставить её думать меньше, чем брать модель слабее и выкручивать размышления на максимум.

Ну и отдельная тема - кэш.

Если очень просто, Claude может запоминать часть уже обработанного контекста, чтобы не перечитывать одно и то же заново и не брать за это полную стоимость.

Но сломать этот кэш оказывается очень легко.

Добавили постоянно меняющееся время или ID в системный промпт - кэш может сброситься.

Поменяли порядок инструментов - тоже.

А если агент слишком долго выполняет какую-то задачу, кэш вообще может успеть закончиться по времени.

Anthropic уже добавила инструменты для поиска таких проблем прямо в Claude Code.

/claude-api prompt-audit - проверяет старые промпты и инструкции.

/claude-api cost-optimize - ищет, где можно уменьшить расходы на API.

Короче, при выходе новой модели недостаточно просто поменять её название в настройках.

Старые CLAUDE.md, скиллы, промпты и настройки effort тоже имеет смысл пересматривать.

Некоторые инструкции, которые раньше реально помогали модели, сейчас могут просто заставлять её делать лишнюю работу и сжигать токены.

YOUTUBE | ЧАТ
  • ❤ 2
  • 👍 1
  • 🔥 1
More from @cryptopiy_cryptofuture
  1. Sep 29, 2026Да почему так быстро! Только тесты на 6 сол снял сразу другая модель выходит
  2. Sep 29, 2026GPT 6 Sol создал GTA на 3 движках используя mcp Blender🧡 С видео чуть запоздал, но тем не…
  3. Sep 27, 2026Разработка GTA через VECTA используя GPT 6 Sol В этот раз тестировал GPT 6 Sol немного ина…
  4. Sep 25, 2026Claude Opus 5.5 создал Майнкрафт на 3 движках используя mcp Blender🧡 Решил не делать свои…
  5. Sep 22, 2026GPT 6 Astra и Claude Fable 5.1 одновременно сделали 2 игры через Mirasim В этот раз тестир…
  6. Sep 20, 2026GPT 6 Astra создал GTA на 3 движках используя mcp Blender🧡 Ранее я уже выпускал подобное…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →