DeepSeek выкатил V4.1 Flash и отправил на пенсию собственный Pro
10 сентября DeepSeek опубликовал V4.1 Flash. 552B MoE, новая схема Causal Encoder–Decoder: 8B активных параметров на входе, 16B на выходе. Нативный vision, контекст до 1M токенов, KV-кэш 890 байт на токен — в четыре раза меньше, чем у прошлого Flash, и на два порядка меньше, чем у первых моделей компании.
Цифра, из-за которой пост стоит слать коллегам: Terminal-Bench 2.1 — 90.6. Выше собственного V4 Pro (87.9), Kimi K3 (88.3) и GPT-5.6 Sol (88.8). DeepSeek прямо пишет: сторонние прогоны поставили Flash впереди Pro по качеству, цене и скорости, поэтому Pro снимают. С 14 сентября 04:00 UTC deepseek-v4-pro будет резаться на Flash по цене Flash.
В API модель зовётся deepseek-flash. Старые алиасы пока редиректят сюда. Для команд, которые крутят агентов на длинном репозитории, узкое место давно не «ум модели», а префилл и память. Flash собран именно под этот профиль. Проверяйте не маркетинг, а свой воркфлоу: если у вас короткие чаты — выигрыш будет меньше, чем на Terminal-Bench.
Источник: DeepSeek, 10 сентября · Reuters
#DeepSeek #LLM #AIAgents #OpenSourceAI
Post #709
47

- ❤ 3