Закинуть весь легаси-монолит в один промпт и не обанкротиться? Вышла DeepSeek-V4.
Спустя 484 дня после релиза V3 разработчики выкатили две MoE-модели с окном контекста на 1 миллион токенов:
→ DeepSeek-V4-Pro (1.6T параметров, активно 49B): бенчмарки показывают новый open-source SOTA в Agentic Coding и математике.
→ DeepSeek-V4-Flash (284B параметров, активно 13B): легкая и быстрая версия для рутинных тасок.
Почему это меняет правила игры:
Новая архитектура с гибридным вниманием (CSA + HCA) снизила потребление KV-кэша почти на 90%. Как итог: API стоит $1.74 за 1M input-токенов — это примерно в 6 раз дешевле, чем GPT-5.5 или Opus 4.7. Модель «из коробки» интегрирована с ИИ-агентами вроде Claude Code, поэтому скармливать нейронке огромные репозитории целиком теперь не только возможно, но и рентабельно.
#AIcoding #LLM #AIAgents
DeepSeek V4 Preview Release (Официальная документация)
Post #401
93

- ❤ 3
- 👍 1
- 🔥 1
- 😁 1