4 модели , все с нативным контекстом 1M токенов:
- DeepSeek-V4-Pro: 1.6T всего, 49B активных, 1M контекст — флагман фронтир-уровня
- DeepSeek-V4-Flash: 284B всего, 13B активных, 1M контекст — оптимизирован под скорость
- DeepSeek-V4-Pro-Base: предобученная база 1.6T для постобучения и исследований на фронтир-уровне
- DeepSeek-V4-Flash-Base: предобученная база 284B для эффективной адаптации под домен
Ключевое изменение, в том , что контекст на миллион токенов стал стандартом во всех официальных сервисах: без разделения по версиям и тарифам.
Три режима инференса: Non-Think / Think High / Think Max - позволяют управлять глубиной рассуждения. В режиме Think Max V4-Pro показывает 93.5 на LiveCodeBench, 3206 на Codeforces и 95.2 на HMMT 2026, сокращая разрыв с ведущими закрытыми моделями в задачах рассуждения и агентных сценариях.
V4 оптимизирован под работу с популярными агентными инструментами, включая Claude Code и OpenClaw. API поддерживает форматы OpenAI ChatCompletions и Anthropic, переключение сводится к смене параметра модели. Старые интерфейсы deepseek-chat и deepseek-reasoner будут работать ещё три месяца, после 24 июля сервис остановится, стоит заранее сделать миграцию.
Попробовать можно в чате через режим Expert Mode / Instant Mode. API обновлён и уже доступен.




