Anthropic выпустила Mythos 😮
На релизе ее назвали Fable 5. Компания несколько месяцев считала ее слишком опасной для открытого доступа, потому что модель автономно находила уязвимости в Linux, macOS, Firefox. Еще и сама писала рабочие эксплойты. Держали за закрытыми дверями, теперь открыли, но с ограничениями. Цифры говорят сами за себя:
• SWE-bench Pro — 80.3 (GPT-5.5: 58.6, Gemini 3.1 Pro: 54.2)
• Humanity's Last Exam — 64.5 с инструментами (GPT-5.5: 52.2)
• Код на реальных задачах CursorBench — до 72.9% при максимальном режиме мышления
• FrontierCode Diamond — 30.9% на максимуме, у GPT-5.5 потолок 5.7%
• HealthBench Professional — 66.0 vs 51.8 у Gemini
Главная фишка — чем больше времени и бюджета даём модели на задачу, тем сильнее отрыв от конкурентов. На дешёвых запросах разница небольшая, на дорогих — пропасть.
Fable 5 доступна прямо сейчас в Claude.ai.
@creativethecreator
Post #2546
378

- ✍ 4
- 🔥 4
- ❤ 1
- 😱 1
- 🤩 1