Контекст 262K, до 131K токенов на ответ, на входе текст и картинки, tool calling и JSON-режим без строгой схемы. Работает через одного провайдера, и он небыстрый: около 23 токенов в секунду и 17 секунд до первого токена. Модель думает скрыто: в моём прогоне лимит в 300 токенов на ответ целиком ушёл на рассуждения, а в ответ попали два слова. На вопрос «кто ты» отвечает «Union Alpha, создатель анонимен».
Из бенчмарков пока только внутренний замер OpenCode на Terminal-Bench v4.0, они выложил его в ответ на вопрос о результатах: около 52% при ожидаемой цене примерно $1,6 за задачу. Это выше Claude Opus 5 (max), GLM-5.3 (max) и GPT-5.6 Sol (max), чуть ниже GPT-6 Astra (high), и по цене на Парето-линии между GLM-5.3-Flash и GPT-6 Astra. В треде гадают на MiniMax M3.1 или Kimi K3.1, самой модели про это не известно. Прошлый стелс Ox Alpha оказался GLM-5.3-Flash от Z․ai, так что через неделю-две узнаем.
Подключается как
stealth/union-alpha в любом OpenAI-совместимом клиенте, в OpenCode она уже в списке.@neuro_channel
