Версия стала лучше в кодинге, рассуждении, агентных задачах и работе с длинным контекстом, причем цена для обычного использования не изменилась. Главный вайб релиза не в «вау, все в космос», а в том, что модель стала более осознанной: чаще замечает свои ошибки, честнее говорит об ограничениях и лучше ведет себя в долгих задачах.
Что по плюсам. Во‑первых, заметно выросли метрики в кодинге: Anthropic пишет о лучших результатах на сложных бенчмарках вроде SWE-bench Pro и Terminal-Bench 2.1. Во‑вторых, модель стала полезнее для агентных сценариев — особенно там, где нужно долго держать контекст и не терять нить проекта. В‑третьих, у релиза есть приятные фичи для разработчиков: dynamic workflows в Claude Code, управление effort в claude.ai и более дешевый fast mode.
Но минусы тоже есть, и они не косметические. DataCamp отмечает, что у Opus 4.8 есть регресс по prompt injection: без защит успешность атаки выросла примерно до 7% против 2.3% у 4.7, хоть с защитами это и снижается. Еще один момент — прирост в agentic‑задачах местами скромный, а в некоторых тестах есть просадки, так что это не «революция», а скорее очень сильный апдейт.
Мое мнение: если ты работаешь со сложными или уже готовыми проектами, где важны контекст, аккуратность и многошаговая логика, то Claude Opus 4.8 выглядит очень солидно. Для учебных задач и простых запросов его мощь может быть даже избыточной, но для реального продакшн-кода и больших кодовых баз — прям топовый кандидат.
