Anthropic выкатила Claude Fable 5.1 и Mythos 5.1
Несмотря на .1 в названии, апдейт получился довольно крупным. Сильнее всего прокачали кодинг, долгие агентные задачи и работу над научными исследованиями.
Напомню, Fable 5.1 и Mythos 5.1 внутри используют одну и ту же модель. Fable доступна обычным пользователям, а Mythos получает более свободные ограничения в кибербезопасности и биологии и пока выдается проверенным исследователям и организациям.
Рост хорошо виден по бенчмаркам. На Terminal-Bench-Science Fable 5.1 набрала 52,6% против 24,7% у Fable 5, 29% у Opus 5 и 22,4% у GPT-5.6 Sol. В агентном кодинге на Terminal-Bench 4.0 результат вырос с 42% до 55,8%, у Opus 5 там 52,3%.
В одном эксперименте Fable 5.1 работала над ML-задачей 38 часов, сама нашла ошибку, исправила ее, запустила несколько экспериментов и вернулась с результатами и следующими шагами.
Цены API остались $10 за миллион входных и $50 за миллион выходных токенов, чтение закэшированного контекста при этом подешевело на 75%, до $0,25 за миллион токенов, что особенно заметно в длинных агентных сессиях.
В целом модели все лучше умеют часами вести одну задачу, держать большой контекст, сами запускать эксперименты и доводить работу до результата, и именно такие длинные автономные сценарии сейчас становятся одной из главных зон гонки между лабами.
Детали: https://www.anthropic.com/claude-fable-and-mythos-5-1
Post #1966
2.93K

- 🔥 7
- ❤ 6
- 👍 1