Относительно Hy3 это существенное улучшение, местами результат вырос вдвое. В терминальных задачах модель встала вровень с GLM 5.3 и Kimi K3, а на DeepSWE, агентских бенчах и Humanity's Last Exam всё ещё заметно уступает Kimi, Sol и Opus 5. Первая лига открытых моделей, но не лидер.
Любопытна оценка людьми: 163 инженера Tencent вслепую сравнивали ответы на 203 рабочих задачах, и Hy4 preview выиграл у GLM 5.3 и Kimi K3 с небольшим перевесом. Известные проблемы признают сами: думает дольше нужного и перепроверяет себя.
Запуск через vLLM или SGLang, рецепты в карточке модели; режим без рассуждений включается
reasoning_effort: no_think.@neuro_channel
