TGViewer
Machinelearning Machinelearning @ai_machinelearning_big_data · 280K subscribers
Post #10239 33K
Anthropic только что выпустила Claude Opus 4.8.

Anthropic только что выпустила Claude Opus 4.8.
Три конкретных изменения по сравнению с 4.7: точнее судит о ситуации, честнее говорит о собственных ограничениях и дольше держит контекст при самостоятельной работе без подсказок.

По бенчмаркам: agentic coding (SWE-Bench Pro) 69.2% против 64.3% у 4.7 и 58.6% у GPT-5.5. Computer use (OSWorld) 83.4%. Knowledge work (GDPval-AA) 1890 против 1753 у предыдущей версии. В терминальном кодинге GPT-5.5 пока впереди с 78.2% против 74.6%, но разрыв небольшой.

Цена не изменилась.
В релизе упоминается апдейт про "более честную оценку собственного прогресса" — это прямо отвечает на одну из главных болей при работе с агентами: модель уверенно сообщает, что задача выполнена, хотя на самом деле застряла. Посмотрим, насколько это реально изменилось на практике.

claude.com/blog/introducing-dynamic-workflows-in-claude-code
  • ❤ 104
  • 👍 47
  • 🤔 34
  • 🔥 20
  • 👏 14
  • 🤓 4
  • 😁 2
  • 💘 1
More from @ai_machinelearning_big_data
  1. Sep 23, 2026✔️ OpenAI расширила Academy до 14 курсов OpenAI добавила в свою образовательную платформу…
  2. Sep 23, 2026Рынок ИИ смещается от отдельных ML-инструментов к horizontal AI — универсальным агентам, к…
  3. Sep 23, 2026📱 Qwen представила Qwen Intelligence - набор ИИ-агентов для смартфонов. В основе три аген…
  4. Sep 23, 2026✔️ OpenAI начала работать с независимым советом математиков Компания будет советоваться с…
  5. Sep 23, 2026Многие компании уже запускают ИИ-проекты, но далеко не все доводят их до результата. Для э…
  6. Sep 23, 2026📌 Codex на GPT-6 Astra выиграл все парти в бенчмарке по StarCraft Бен Свердлоу, соосноват…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →