Вау, а как вам такой бенч? Где Qwen 3.6 Max и Sonnet якобы круче Fable во фронтенде, Qwen 3.6 Plus обходит его в рефакторинге, а Grok 4.3, Qwen и Gemini — «лучшие» по галлюцинациям. По их количеству, видимо.
И вот этот пиздец реально кто-то воспринимает всерьёз. Автор — шизанутый блогер BridgeMind, который постоянно постит дичь в твиттер. Теперь выкатил это, и в его говнобенч почему-то поверили — паблики на два миллиона подписчиков (как выше) на основе этого кринжа уже постят, что GLM 5.2 лучше Fable
А на деле он, скорее всего, не дотягивает даже до годовалых Opus 4 или GPT o3. Большинство китайских моделей и GLM в агентах люди юзают только потому, что в каком-то сервисе они появились за бесплатно 🙃
Post #1123
1.65K



- 😁 12
- ❤ 5
- 🤪 3
- ❤🔥 1
- 👍 1