TGViewer
Нейроканал Нейроканал @neuro_channel · 11.7K subscribers
Post #2719 2.17K
Z․ai выпустила GLM-5.3. База осталась та же, что у GLM-5.2: MoE на 743 млрд параметров с контекстом в миллион токенов. Заново модель не учили, весь прирост дало дообучение поверх готовой базы на средах с долгими задачами вроде тех, над которыми инженер сидит несколько дней.

В кодинге компания заявляет плюс 50% к GLM-5.2 на своём внутреннем наборе задач и первое место среди открытых моделей. Модель стала ещё и экономнее: на высоком уровне размышлений она решает 31,4% задач примерно за 50 тысяч выходных токенов, Opus 4.8 набирает 29,5%, но тратит 120 тысяч. Fable 5 впереди с 39,5%.

Неожиданной для самой компании оказалась кибербезопасность. В обучение добавили данные про поиск уязвимостей, и модель начала не просто находить отдельные дыры, а выстраивать цепочки эксплуатации целиком. На CyberGym это лучший результат среди всех замеренных моделей, на ExploitBench счёт вырос вдвое, хотя до закрытых моделей там ещё далеко.

Проверяли и вне бенчмарков: вместе с китайскими командами безопасности модель прогнали по реальным репозиториям и нашли 2436 уязвимостей в 269 проектах, 1097 из них средней и высокой критичности. Самая старая попала в код в 1981 году, в среднем дыра жила 26,6 года до находки. Все результаты ведут в публичном реестре, 53 уже раскрыты, остальные под эмбарго.

Из-за этого веса впервые задержали: обещают выложить через две недели после запуска, когда закончат проверку на безопасность. Пока попробовать можно по подписке GLM Coding Plan и в среде ZCode, модель работает и в Claude Code с OpenCode. Отключать размышления больше нельзя, вместо этого три уровня усилия, для кода рекомендуют максимальный.

Бенчи на картинке, смотрите сами, моделька получилась очень крутая. Надо тестировать на реальных задачах теперь. Уже возобновил подписку, с сегодняшнего дня буду проверять.

@neuro_channel
  • 🔥 12
  • ⚡ 3
More from @neuro_channel
  1. Sep 20, 2026Tencent выложила WeVisDoc, модели на 2 и 4 млрд параметров, которые превращают снимок стра…
  2. Sep 19, 2026StepFun выпустила Step 5 Preview, и Artificial Analysis уже её замерили: 44 балла в индекс…
  3. Sep 19, 2026На следующей неделе ожидается сразу несколько крупных релизов. Расскажу про самые интересн…
  4. Sep 18, 2026Qwen выложила Qwen3.8-Omni-Flash: на вход текст, картинки, звук и видео, контекст 1M токен…
  5. Sep 18, 2026PrismML выпустила Ternary Bonsai 2 27B: тернарное сжатие теперь сделано поверх Qwen3.8 27B…
  6. Sep 17, 2026Стелс-модель Union Alpha раскрылась: это Pareto 26.9 от компании The Unbiased Company. Вче…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →