TGViewer
Нейроканал Нейроканал @neuro_channel · 11.7K subscribers
Post #2882 2.16K
GLM-5.3 лучше всего работает в своём родном харнессе. Z․ai прогнала ZCode по FrontierHarness Eval: связка ZCode + GLM-5.3 решает 82,2% задач при $1,98 за прогон. Та же модель в Claude Code даёт 80% за $2,59, в Codex 66,7%, в Pi 60%, в OpenCode 46,7%. GLM-5.3-Flash в ZCode решает 75,6% за $0,16, самая дешёвая точка на графике.

FrontierHarness Eval это открытый бенчмарк на 30 задач из Terminal-Bench и DeepSWE, где меняют не модель, а харнесс: в базовом прогоне Kimi K3 гоняли через девять харнессов, и при близком проценте решённых задач стоимость отличалась в 17,5 раза. На прошлой неделе разработчик из сообщества прогнал по тому же набору GLM-5.3 в Claude Code, Codex, Pi и OpenCode, а сегодня Z․ai дописала ZCode, по три прогона на связку.

Для тех, кто сидит на GLM-5.3, вывод практический: между ZCode и OpenCode на одной модели разница в 35 пунктов, а Claude Code с GLM внутри почти не отстаёт от ZCode, но выходит на 30% дороже.

@neuro_channel
  • 👍 6
  • 💯 1
More from @neuro_channel
  1. Sep 20, 2026Tencent выложила WeVisDoc, модели на 2 и 4 млрд параметров, которые превращают снимок стра…
  2. Sep 19, 2026StepFun выпустила Step 5 Preview, и Artificial Analysis уже её замерили: 44 балла в индекс…
  3. Sep 19, 2026На следующей неделе ожидается сразу несколько крупных релизов. Расскажу про самые интересн…
  4. Sep 18, 2026Qwen выложила Qwen3.8-Omni-Flash: на вход текст, картинки, звук и видео, контекст 1M токен…
  5. Sep 18, 2026PrismML выпустила Ternary Bonsai 2 27B: тернарное сжатие теперь сделано поверх Qwen3.8 27B…
  6. Sep 17, 2026Стелс-модель Union Alpha раскрылась: это Pareto 26.9 от компании The Unbiased Company. Вче…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →