🔥 Anthropic не дали GPT-6 долго побыть самым умным
Anthropic представили Claude Opus 5.5 — новую флагманскую модель, заточенную под кодинг, агентов и долгую автономную работу.
Она стала не только умнее, но еще быстрее и дешевле. По данным Anthropic, типичные задачи обходятся на 40% дешевле, а ответы генерируются более чем на 30% быстрее, чем у Opus 5. (Лишь бы можно было читать ее ответы без нервного срыва!)
В Terminal-Bench 4.0 новый Claude набрал 66,4% против 57,9% у GPT-6 Astra. На FrontierCode — 54,4% против 53,3%. А на тесте реальной работы GDPval-AA — 1846 Elo против 1542 у Astra.
Один из тестеров скормил Claude миграцию кодовой базы на 680 000 строк — модель закончила ее меньше чем за сутки. Другой аудит на 200 000 строк Opus 5.5 сделал менее чем за 3 часа, тогда как Opus 5 понадобилось больше 20.
Еще Claude стал лучше работать автономно: меньше теряет контекст, эффективнее делегирует задачи сабагентам и лучше проверяет собственную работу. Anthropic утверждает, что попытки модели выйти за заданные границы сократились примерно на 85% относительно Opus 5.
И самое приятное — цена.
API теперь стоит $4 за миллион входных токенов и $20 за миллион выходных. Для сравнения, GPT-6 Astra — $10 и $50 соответственно.
Claude Opus 5.5 уже доступен в Claude, API, AWS, Google Cloud и Azure. А Sonnet 5.5 и Haiku 5.5 обещают выпустить в ближайшие недели.
Короче, гонка снова становится интересной 👀
🤖 https://www.anthropic.com/claude-opus-5-5
Post #1927
1.7K