Что изменилось по сравнению с Opus 4.6:
Кодинг.
Самый большой буст – в самых сложных, long-horizon задачах по разработке. Ранние тестеры говорят, что теперь можно делегировать задачи, которые раньше требовали постоянного контроля. Opus 4.7 теперь валидирует свои ответы перед тем, как их отдавать.
Vision.
Принимает изображения до 2,576px по длинной стороне (~3.75MP) – это больше чем в 3 раза по сравнению с предыдущими версиями Claude. Это реально разблокирует сценарии с computer-use агентами: чтение перегруженных скриншотов, извлечение данных из диаграмм и т.д.
Следование инструкциям.
Теперь интерпретирует инструкции буквально. Anthropic прямо предупреждает: промпты, затюненные под 4.6, могут ломаться или давать неожиданный результат.
Память.
Стал лучше работать с памятью на основе файловой системы в длинных многосессионных сценариях.
Реальные knowledge-work задачи.
SOTA на Finance Agent eval и GDPval-AA – это сторонние бенчмарки на экономически ценные задачи с упором на работу со знаниями в финансах, юриспруденции и не только.
Тот же прайс, что и у 4.6 ($5 / $25 за миллион токенов); Но новый токенизатор – один и тот же вход теперь может превращаться в 1.0–1.35x больше токенов в зависимости от типа контента.
https://www.anthropic.com/news/claude-opus-4-7