Anthropic дропнули Claude Fable 5 та Mythos 5: що під капотом і чи варто напружуватись
Anthropic викатили свої найпотужніші моделі класу Mythos, які офіційно стали доступними для широкого загалу. Fable 5 — це історія про складні, довготривалі та асинхронні таски. Там, де інші моделі починають галюцинувати і губити контекст, ця може автономно працювати днями.
Що вміє і до чого тут ми:
- Рефакторинг промислових масштабів. На закритих тестах Stripe нацькували Fable 5 на свою кодову базу Ruby. Модель мігрувала 50 мільйонів рядків коду рівно за один день. Для порівняння: руками б це зайняло у команди понад два місяці.
- Фронтенд по картинці та ігри. Модель здатна відновлювати вихідний код веб-додатків суто по скріншотах. Заради фану їй навіть дали пограти в Pokémon FireRed — вона пройшла гру, орієнтуючись виключно на сирі пікселі, без доступу до карти чи ігрового стану.
- Топові бенчмарки. Fable 5 забрала найвищий бал на FrontierCode від Cognition серед усіх frontier-моделей.
- Автономність. Через утиліти на кшталт Claude Code модель здатна сама планувати підхід до задачі, чекати результатів, перевіряти прогрес і самостійно коригувати свою ж роботу, якщо десь помилилась.
Безпека і милиці під капотом
Оскільки модель вийшла занадто розумною (особливо в пошуку вразливостей), Anthropic прикрутили жорсткі запобіжники. Якщо ти попросиш Fable 5 написати щось, що система класифікує як питання з кібербезпеки, твій запит непомітно перекинуть на старішу модель — Claude Opus 4.8. Фільтр налаштований відверто параноїдально і може хибно спрацьовувати на цілком звичайні робочі запити десь у 5% сесій.
Прайсинг:
Просять $10 за 1 млн вхідних токенів та $50 за 1 млн вихідних. Це більш ніж удвічі дешевше, ніж попередній Claude Mythos Preview.
Підсумок:
Моделі на папері вийшли крутими, але головне питання суто для мене навіть "щоб що? І які задачі мені не закриває Opus?". Плюс ціна: моделі коштують мінімум x2 від ціни Opus.
Post #1360
1.02K

- ❤ 16
- 👀 4
- 👌 1