TGViewer
Industrial Ai | Stanislav Dmitriyev Industrial Ai | Stanislav Dmitriyev @stas_dmitriyev · 243 subscribers
Post #287 72
🔍Anthropic выкатили новую модель. Цифры выглядят слишком хорошо.

По заявленным бенчмаркам Claude Mythos 5 / Fable 5 обгоняет GPT 5.5 практически везде:

✈️Что важно:

• 80.3% против 58.6% в SWE-Bench Pro
• 29.3% против 5.7% в FrontierCode
• 78% против 34% в кибербезопасности
• 66% против 51.8% в медицинских задачах
• 59% против 41.4% в Humanity’s Last Exam

Если верить этим цифрам, то местами преимущество выглядит не на проценты, а в разы.

Тут возникает вполне логичный вопрос.

Неужели GPT 5.5 настолько отстал?

Или Anthropic себе бенчи в нанабанане нарисовали? 🙂

Впрочем, когда OpenAI, Anthropic, Google и остальные начинают бороться за первое место, выигрывает обычно не лидер рейтинга.

Выигрывают пользователи.

Ждём ответку от OpenAI. 🍿

↗ Ссылка на статью
⚡ via Industrial Ai
More from @stas_dmitriyev
  1. Oct 2, 2026Channel name was changed to «Industrial Ai | Stanislav Dmitriyev»
  2. Oct 2, 2026🔍 Dyno Nobel показала полный автономный цикл подготовки взрывных скважин. Для меня это са…
  3. Oct 1, 2026🔍 А ваша компания может быстро пересчитать экономику рудника? В предыдущем посте — возмож…
  4. Oct 1, 2026🔍 Пошлина на медный концентрат: а что получат другие предприятия? Казахстан рассматривает…
  5. Oct 1, 2026🔍 Google выпустила Gemini 4 Argon — новую frontier-модель. Судя по опубликованным Google…
  6. Oct 1, 2026🔍 Sandvik показала AI-агента для реальной работы на буровой. На испытательном руднике в Т…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →