Кто стоит за новой Ox Alpha?
Анонимная модель для кодинга и агентных задач появилась на OpenRouter в конце прошлой недели и наделала много шума.
Независимый разработчик Бен Дэвис в первом тестировании прогнал Ox Alpha через 10 задач из теста DeepSWE и получил ошеломляющие 80% правильных ответов против 65% у Claude Fable 5.
В новом тесте на 113 задачах результат вышел скромнее — 63% правильных решений. Это примерно на уровне GPT-5.6 Sol и немного хуже Claude Fable 5.
Кто автор модели? Большинство улик указывают на семейство GLM-5 от китайской Z.ai. Официальных подтверждений пока нет.
Протестировать можно бесплатно: OpenRouter
🟩 GPT, помоги!
Post #3344
16.4K

- ❤ 10
- 🤯 7
- 👀 4
- 👨💻 2