Модель пока выпущена в stealth-режиме: разработчик официально неизвестен. Но характеристики уже довольно безумные:
— 1M контекста
— до 128K output
— нативно понимает text + images + video
— reasoning + tool calling
— заточена именно под long-horizon coding и агентские задачи
И самое интересное — первые тесты.
Один из исследователей прогнал Ox Alpha на одинаковом subset из 10 задач DeepSWE:
GPT-5.6 Sol — 52%
Fable 5 — 65%
Ox Alpha — 80%+
То есть на этом маленьком прогоне она действительно разнесла и Fable, и Sol.
Но тут важная оговорка: это всего 10 задач из 113 в DeepSWE, а не полноценный benchmark. Поэтому писать, что Ox Alpha уже официально обошла frontier-модели на 20–30%, пока рано. Но сигнал всё равно очень сильный.
Теперь самое интересное: что это вообще за модель?
Сначала я подумал на MiniMax. У них как раз где-то рядом должна появиться M3.1 / следующая большая M3: 1M context, сильная нативная мультимодальность — всё сходится.
Но модель уже начали fingerprint'ить, и сейчас улики гораздо сильнее ведут к Z.ai / GLM.
В одном tokenizer-тесте Ox Alpha дала 60/60 точных совпадений с GLM-5.2. Для сравнения, с MiniMax M3 совпала только 1 строка из 60.
Плюс API-профиль практически один в один как у свежего GLM-5.3: reasoning обязателен, те же
low / high / max, default max, очень похожие параметры и размеры контекста/output. А в некоторых сессиях Ox Alpha вообще умудряется представляться как GLM от Z.ai 😅При этом обычный GLM-5.3 сейчас text-only, а Ox Alpha умеет image/video. Поэтому моя ставка сейчас такая:
это не MiniMax, а скрытый multimodal checkpoint семейства GLM-5.x — условный GLM-5.3V / следующий GLM.
Китайское происхождение почти наверняка: на части политически чувствительных запросов модель ведёт себя ровно как модели с китайским server-side guardrail. Но «она не любит вопросы про Тайвань → значит MiniMax» — уже слишком слабая улика.
А теперь самый мёд: OpenCode дал Ox Alpha бесплатно на неделю с практически безумными лимитами. Они заявляют near-unlimited usage и capacity до 100 триллионов токенов в сутки.
На OpenRouter модель тоже сейчас стоит $0 / $0 за миллион токенов.
Короче, я бы прямо сейчас шёл и жёг её на больших coding-задачах. Если это действительно следующий GLM, то Z.ai опять каким-то образом очень быстро подобрались вплотную к закрытому frontier.