TGViewer
Data Secrets Data Secrets @data_secrets · 94.3K subscribers
Post #9483 29.9K
Наглядно о том, насколько далек новый Fable от того, что мы получили изначально

Аналитики из BridgeMind провели повторные эвалы модели после возвращения, и вот результат:

Debugging: 86.2 → 25.9
Refactoring: 73.6 → 38.4
Hallucination: 75.9 → 61.7

Сама по себе глупее модель не стала, все дело в новых ограничениях: слишком много задач, даже самых обычных, маршрутизируются к Opus 4.8. Отсюда и просадка в метриках.
  • 😁 60
  • 🫡 33
  • 😭 32
  • ❤ 4
  • 👍 4
  • 🔥 2
  • ⚡ 1
  • 🏆 1
  • 💘 1
More from @data_secrets
  1. Oct 1, 2026FigureAI заставляют своих роботов предыдущего поколения бросаться в лаву, чтобы избавиться…
  2. Sep 30, 2026Gemini 4 Argon, сводка: — По бенчмам все супермощно, на многих тестах это новая SOTA, вклю…
  3. Sep 30, 2026Что, простите? Google только что вернулся в гонку с новой моделью, которая превосходит Ast…
  4. Sep 30, 2026Anthropic призывают ограничить GLM-5.3 В стартапе протестировали модель на способности в о…
  5. Sep 30, 2026Каждую осень у бизнеса просыпается спрос на подрядчиков – бухгалтеров, юристов, маркетолог…
  6. Sep 30, 2026DeepSeek вместе с Huawei разрабатывают альтернативу CUDA Компании выложили в опенсорс набо…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →