Сегодня китайцы одновременно выкатили две модели с «Flash» в названии. И обе — не просто «дешёвые», а реально рабочие для кодинга и агентов.
Qwen3.8-Flash-Next
Это превью архитектуры будущей Qwen 4 (отсюда и Next в названии).
Контекст 262K, расширяется до миллиона. По SWE-bench Pro обходит Claude Opus 4.6 Max (62.5 против 53.4). Обучение обошлось в 9 раз дешевле предыдущего флагмана. Веса открыты, API $0.16/$0.47.
GLM-5.3-Flash
MIT лицензия, нативно мультимодальная, 1 миллион токенов контекста.
До релиза её гоняли как
ox-alpha. Она сразу стала самой популярной моделью недели. И всё это крутилось на китайских чипах (это отдельно отметили при выпуске модели). В тесте DeepSWE 63.4 (у Claude Opus 4.8 — 58).Обе модели уже можно брать и использовать.
Пока OpenAI и Anthropic выпускают очередной frontier за космические деньги, здесь просто кладут на Hugging Face то, что работает и стоит нормальных денег. Что тут добавить... Надо тестировать на реальных задачах
#AI