🏙 Anthropic представили Claude Fable 5.1 и Mythos 5.1
И это довольно большой апдейт.
Fable 5.1 — новая флагманская модель Anthropic для программирования, исследований и долгих агентных задач.
По данным компании, она заметно улучшилась в coding, computer use и научных задачах. Например:
— Terminal-Bench Science: 52,6% против 24,7% у Fable 5
— CursorBench: 73,4% против 70,5%
— AutomationBench: 31,4% против 17,1%
Модель лучше справляется с длинными задачами и чаще проверяет собственную работу
💸 Anthropic также снизила стоимость чтения кэша на 75% — до $0,25 за 1 млн токенов. Типичные задачи, по оценке компании, могут стать примерно на 25% дешевле, а тяжелые агентные сценарии — до 45%.
Отдельно представили Claude Mythos 5.1.
Технически это та же модель, но с другими ограничениями безопасности.
И, как я говорил, гонка AI постепенно смещается от «кто лучше отвечает в чате» к кто способен самостоятельно часами и днями программировать, исследовать и решать реальные инженерные задачи.
Post #1920
3.48K

- ❤ 15
- 👍 1
- 🤔 1