GLM-4.7: УБИЙЦА CLAUDE ИЛИ МАРКЕТИНГ?
Только недавно писал, что пользую дешевую GLM-4.6 внутри Claude Code, а Zhipu AI сегодня выкатили новую версию — 4.7. Тайминг идеальный.
Если верить цифрам Z.AI — китайцы решили переиграть вообще всех. Заявления очень дерзкие:
1. Кодинг — новый топ.
В LiveCodeBench V6 набрали 84.8 балла.
Заявляют это как Open-source SOTA. И самое интересное — утверждают, что это выше, чем у Claude Sonnet 4.5.
2. «Мозги» стали мощнее.
В тесте HLE (Human Last Exam) выдали 42%. Это +38% роста относительно версии 4.6. Скромно пишут, что «приближаются к GPT-5.1».
3. Слепые тесты.
В LMArena Code (где голосуют люди) — 1-е место среди опенсорса и «домашних» моделей.
Мысли: На бумаге выглядит слишком хорошо. Но первое место в LMArena в Code Arena (как “№1 среди open‑source) игнорировать сложно.
Post #28
830

- 👍 3