Лаборатория суперинтеллекта Александра Вана выпустила Muse Spark 1.3, четвёртый релиз модели за пять месяцев. Цукерберг называет его самым большим скачком в кодинге и агентной работе, модель уже в Muse Code и в API, а дальше обещают открытые веса Muse Spark и следующую модель, которую пока обозначают только арбузом.
Artificial Analysis замерила обе версии. Доступная всем xhigh поднялась на 4 балла за месяц и встала вровень с GPT-5.6 Sol и Grok 4.6, версия max пока в закрытом превью и уступает только Claude Fable и Opus. Почти весь рост в агентных задачах: банковский Tau3-Bench прибавил 12 пунктов, а у max это вообще лучший результат среди всех моделей. Просели только длинный контекст и фактологический AA-Omniscience, там модель стала чаще отказываться отвечать.
Цены не менялись: $1,25 за миллион входных токенов и $4,25 за выходные, попадание в кэш $0,15. Выходит $0,55 за задачу индекса, у Sol и Grok того же уровня около $0,95. Токенов на задачу модель тратит больше, чем 1.2, в основном входных.
@neuro_channel
Post #2807
1.99K

- 👍 7