Сегодня DeepSeek пересаживает V4-Pro на Flash и режет счёт
С 14 сентября, 04:00 UTC (у нас уже день), запросы на deepseek-v4-pro идут в V4.1-Flash по цене Flash. Так написано в релизе самой DeepSeek. Старые deepseek-v4-flash и vision-exp тоже режут на новый Flash. Рабочее имя модели в API: deepseek-flash.
V4.1-Flash - MoE на 552 млрд параметров. Архитектура асимметричная: на входе активны 8B, на выходе 16B. Есть нативное зрение. Компания утверждает, что сторонние прогоны ставят Flash выше старого V4-Pro по качеству, цене, скорости и полному времени прогона. Веса на Hugging Face под MIT.
Цифры с их changelog, без маркетингового тумана вокруг « co-pilot for everything »: GPQA Diamond 90.9, Codeforces rating 3471, Terminal-Bench 2.1 - 90.6, DeepSWE v1.1 - 74.2, CyberGym 88.1. Для агентов интереснее не GPQA, а Terminal-Bench и DeepSWE: это уже не сниппет на HumanEval, а работа в чужом контейнере.
По цене SiliconANGLE считает так: пиковый output у V4-Pro был $3.96 / млн токенов, у Flash $1.20. Если вас тихо пересадили, output дешевеет примерно на 70%. Пока не выйдет V4.1-Pro. Часть команд как раз сегодня утром увидит в биллинге не «ухудшили модель», а «внезапно стали меньше платить».
Имеет смысл явно зафиксировать deepseek-flash в конфиге, а не жить на алиасе v4-pro, который теперь значит другое.
Источник: api-docs.deepseek.com/news/news260910
#deepseek #llm #ai #api #agents #opensource
Post #721
50

- 👍 4
- ❤ 2
- 🔥 2