🤚 CLAUDE FABLE 5.1
1 сентября Anthropic релизнула новые флагманские модели - вышли Fable 5.1 и Mythos 5.1 (Mythos правда все еще остается закрытой версией без жестких этических ограничений в ответах).
😁Снижение стоимости использования. Главной проблемой Fable 5 была чересчур завышенная цена за токены. И хотя базовые $10/$50 за миллион токенов остались на месте, но чтение из кэша подешевело на 75% - до $0,25 за миллион. На обычных задачах это дает около 25% экономии против Fable 5, а на длинных агентских задачах - до 45%.
😁На low и medium Fable 5.1 выдает результат на уровне Fable 5 или лучше (и при этом сильно дешевле). В Claude Code по умолчанию стоит high, в Cowork и на claude.ai - medium.
😁На Terminal-Bench-Science (научная работа) модель набрала 52,6% против 24,7% у Fable 5, 29% у Opus 5 и 22,4% у GPT-5.6 Sol - то есть больше чем вдвое обошла предшественника. На AutomationBench (сквозные бизнес-задачи) - 31,4% против 17,1% у Fable 5 и 26,9% у Opus 5. По управлению компьютером на OSWorld 2.0 - 77,9% против 72,9%. На CursorBench 3.2.0 - 73,4%, лучший результат среди всех.
😁 Плюс сделали апгрейд для агентских задач. Browserbase на своем самом сложном бенчмарке отчитались: Fable 5.1 закрыла 82% задач примерно за 10 минут на каждую, против 74% у Opus 5 и 57% у Fable 5 - и при этом сожгла меньше токенов. Вот другой отзыв: примерно вдвое быстрее Opus 5 при вдвое меньшем расходе токенов.
😁И кстати, разработчики ослабили этические ограничения, чтобы блокировка не касалась безобидных запросов, как это было с Fable 5. Anthropic заявляют, что теперь кибер-фильтры дают на 60% меньше ложных срабатываний.
В общем, релиз вполне достойный. Посмотрим, чем ответит OpenAI - по слухам, GPT-6 уже на подходе.
➖➖➖➖➖➖➖➖➖➖➖
🏆🏆🏆🏆🏆 Подписка ❕ Чат
Post #460
1.05K
- 👍 10
- ❤ 3
- 🔥 2