Opus 4.7 вышел
⠀
Anthropic представила Claude Opus 4.7. В анонсе ставка на рабочую надёжность: модель должна увереннее тянуть длинные задачи, точнее держать инструкции и чаще перепроверять свой результат перед ответом.
⠀
По карточке к релизу апгрейд относительно Opus 4.6 выглядит заметно. SWE-bench Pro вырос с 53.4% до 64.3%, SWE-bench Verified с 80.8% до 87.6%, OSWorld-Verified с 72.7% до 78.0%, Finance Agent v1.1 с 60.1% до 64.4%. В graduate-level reasoning потолок уже плотный: 94.2% у 4.7 против 94.4% у GPT-5.4 Pro и 94.6% у Mythos Preview.
⠀
Самый интересный кусок здесь в позиционировании. Anthropic подаёт 4.7 как модель для длинной автономной работы, где нужно держать ход задачи, проверять себя по пути и меньше требовать ручного надзора.
В модель встроили блокиратор попыток использования модели для взлома ПО. Без успешного тестирования функции выпуск Mythos в паблик под вопросом.
⠀
Кто-то проверит, Claude отпустило? Всё ждали выхода 4.7...
⠀
📎 X
Post #8411
1.59K
