📺 Opus 5 забрался на первое место в рейтинге LM Arena, и всё выглядит так, будто Fable 5 в агентных задачах больше не нужен.
На тесте по многошаговым автоматизациям Opus 5 обходит предыдущую модель почти в полтора раза - 26% против 17,4%. Для бота, который сам ведёт сделку по воронке или сверяет заявки с базой, это уже разница, которую видно в реальной работе.
Но по чистому коду картина другая. На тесте DeepSWE Opus 5 и Fable 5 идут вровень - 68,8% против 69,7%, а лучший результат вообще у GPT-5.6 Sol - 72,7%. Для тяжёлых задач разработки менять модель по умолчанию пока рано.
Преимущество Fable в кодинге не такое уж и большое с выходом новой модели. Да еще тратит куда больше токенов - у ребят из нашего клуба начали заканчиваться еженедельные и сессионные лимиты с подпиской Max.
Тогда, что лучше:
Opus 5 или Fable?
AI Practiq
Post #332
328

- ❤ 2