TGViewer
Evgeny Kuznetsov | DataHints – анализ и визуализация данных в маркетинге Evgeny Kuznetsov | DataHints – анализ и визуализация данных в маркетинге @datahints · 172 subscribers
Post #398 123

Forwarded from Refat Talks: Tech & AI

Итак, вышла Claude Mythos Fable 5.

Соберем что мы об этом знаем в одну кучу и будем дополнять.

- Официальный блогпост с видео-демками и графиками, ютуб-тизер и Системная карта с деталями.

- Claude Fable 5 и Mythos 5 - это одни и те же веса, но с разными предохранителями. Fable для всех, Mythos - для доверенных партнеров

- Новый класс моделей "Mythos-class". SOTA почти на всех бенчмарках, самые большие отрывы - на длинных и сложных задачах. Бенчи пересказывать не буду - посмотрите в блогпосте и постепенно появляются все больше независимых.

- в 2 раза дороже Опуса: $10 за млн входных токенов, $50 за млн выходных.

- Доступна в Claude (все платные подписки), Claude Code и по API. Если не видите в CC - обновитесь claude update.

- Всех расстроило это: В подписках включена до 22 июня, дальше по кредитам. То есть через пару недель будет API баланс равный цене вашей подписки (например $100), а выше него - уже только при оплате за API-токены. Пишут будет так пока не найдут компьют.

- Every дали доступ за 5 дней: их видео-обзор и статья - там paywall, но прочитал и вот суть:
- Fable как "warp-двигатель для кода": амбициозные штуки одним промптом, но для понятных и коротких задач дорого и медленно.
- Скачок виден на больших автономных билдах, а не на рутине.
- На их внутреннем инженерном бенче: Fable 91/100 (Opus 4.8 - 63 и GPT-5.5 - 62).
- Сделал клон их продукта "Proof" (collaborative document editor) с одного промпта без доступа к исходному коду за ≈3 часа.
- В другом тесте снял скриншоты собственной работы на desktop и mobile, нашёл визуальные дефекты и починил - QA встроен в рабочий цикл без отдельного промпта.
- По их наблюдениям чинит корневую причину, а не симптом.
- Пишут что старые скиллы могут ограничивать новые модели (например Fable делает PowerPoint лучше, когда ему сказали вообще не использовать скилл, а просто дали бренд-гайдлайны)
- При этом текст пишет не чуть хуже Opus-а
- Самое сильное преимущество вне кода - суждение, особенно с большим контекстом


- Кто еще получил ранний доступ к модели? Пост Ethan Mollick, Claire Vo - подкаст How I AI

- Про предохранители: когда пишешь запросы про кибербез, био/хим и дистилляцию, срабатывает защита и переключает на Opus (в <5% сессий как пишут), и тебя об этом уведомляют. Но ложные срабатывания реальны: на reddit уже ловят баны за легитимный dual-use. Обещают уменьшать false positive.

- Когда вообще брать Fable. Модель заточена под долгие автономные/агентные задачи: "может работать днями, и чем длиннее задача, тем больше отрыв". На коротких правках разницы с Opus 4.8 часто не почувствуешь, а платишь 2x. Именно на ней Борис Черный видимо почувствовал силу Loop Engeneering.

- Интересно что максимум effort не всегда дает лучше результат - об этом пишут Every на своих тестах письма.

- Шуточный Elevator-bench уже давненько был изчерпан, но если интересно, то вот лифт Fable.

- Мои тесты пока скромные: работает визуально даже быстрее (видимо потому что делает меньше tool-колов) и внимательнее, но у меня не так много задач с которыми Opus 4.8 не справлялся бы, надо больше тестить.

Пишите свои наблюдения и что интересненького нашли по теме - буду дополнять пост.
  • 👍 2
More from @datahints
  1. Aug 3, 2026Почему Алиса AI цитирует одни сайты и игнорирует другие? Вместе с нашим SEO-лидом Олегом У…
  2. Jul 9, 2026Пипец я тут триллер пережил... В общем решил запилить бота, которому буду кидать ссылки из…
  3. Jun 23, 2026В Яндекс Тег Менеджере появились сабконтейнеры — дополнительные рабочие пространства внутр…
  4. Jun 23, 2026Вот прям в точку... Написал с помощью агентов цепочку витрин для разметки трафика, мэтчинг…
  5. Jun 23, 2026photo post
  6. Jun 22, 2026«А что, так можно было?» Именно такую реакцию мы чаще всего слышим, когда показываем клиен…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →