вчера вышел новый соннет. в нескольких бенчмарках уже рядом с opus 5.5, а gpt-6-sol и вовсе обгоняет в долгих задачах
> в CursorBench 4.0 набрал 55,5% против 34,1% у прошлого Sonnet
> подтянули тексты, дизайн интерфейсов и работу с документами
цены оставили прежними: $2 за млн input и $10 за млн output. при этом ответы генерирует на 30%+ быстрее прошлого Sonnet
а вот с effort есть интересный момент
на FrontierCode настройка
max дала результат хуже, чем xhigh. модель увлекалась проверками, иногда не успевала закончить или вносила лишние измененияOpus при этом рано списывать. на сложных задачах, где нужно долго разбираться и принимать решения, он всё ещё сильнее
потестить можно бесплатно на claude.ai, без подписки, но конечно с лимитами не разгуляешься
а если хочется погонять основательнее, с здравыми лимитами, то приобрести подписки можно в Boloto Store (мой магаз)
😬 Drops by Miracles: Telegram, Chat, AI Shop
