🚀 Anthropic представила Claude Fable 5.1 и Mythos 5.1
Технически это одна модель, но с разными ограничениями: Fable 5.1 доступна всем пользователям, а Mythos 5.1 - только проверенным организациям для задач в области кибербезопасности и биотехнологий.
Главное улучшение - способность выполнять продолжительные агентные задачи. По данным Anthropic, результат в тесте научных ИИ-агентов вырос с 24,7% до 52,6%, а в автоматизации бизнес-процессов - с 17,1% до 31,4%.
Пока голые цифры - простой пользователь не сильно заметит разницу.
Есть и показательные примеры: модель нашла причину редкого программного сбоя, которую инженеры не могли объяснить несколько лет, а во время 38-часовой автономной работы самостоятельно запустила шесть параллельных экспериментов.
При этом типовые задачи стали примерно на 25% дешевле, а сложные агентные сценарии - до 45%.
На мой взгляд, разработчики конкурируют уже не только в качестве ответов, но и в способности моделей часами выполнять сложную работу, проверять себя и не терять контекст.
Поэтому, Fable 5.1 точно попробовать стоит, тем более, что Fable 5 мне прям очень зашла, особенно в разработке кода, но дорогая, зараза)
Post #687
1.36K

- ❤ 6
- 👍 3
- 👏 1