Промежуточная версия получила новую архитектуру и нативную мультимодальность. Разработчики заявляют улучшение качества ответов, более высокую скорость и снижение стоимости.
На опубликованном скриншоте теста с запросом «Привет»: 159,3 токена/с, 0,3 секунды на рассуждение и 0,8 секунды на весь ответ. Это единичный короткий тест, скорость на сложных задачах ещё предстоит оценить.
Как попробовать через API:
*
base_url остаётся прежним.* Имя модели:
deepseek-v4.1-flash-expires-on-0910.* Тарифы пока такие же, как у V4-Flash.
* Лимит - 20 одновременных запросов на аккаунт.
#DeepSeek #AI

