Claude Opus 4.8 уже здесь — лидер всех бенчмарков возвращается на вершину.
Anthropic особенно гордятся прорывом в честности модели: теперь ИИ не будет утверждать то, что не может обосновать, и сам проверит сомнительные высказывания. К примеру, Opus 4.8 в 4 раза чаще находит ошибки в собственном коде, вместо того чтобы просто сказать «готово».
Доступно для всех в веб-версии — тестируем уже сейчас. 🚀
Program Service
Post #4243
510

- 👏 1