TGViewer
SOF_news SOF_news @sof_news24 · 310 subscribers
Post #1457 58
🤖🇨🇳 DeepSeek V4 Pro: 1,6 трлн параметров, миллионный контекст и переход на китайские ИИ-ускорители
Китайская DeepSeek готовит полноценный выпуск DeepSeek V4 Pro – крупнейшей модели компании, ориентированной на программирование, работу с большими массивами информации и выполнение длительных задач с использованием программных инструментов. Предварительная версия была представлена 24 апреля, а после обновления младшей V4 Flash 31 июля компания сообщила, что окончательный выпуск V4 Pro последует позднее.
Модель содержит 1,6 трлн параметров, однако одновременно используется только около 49 млрд, то есть примерно 3% всей системы. Нужные для конкретной операции части модели подключаются по мере необходимости. Такой подход позволяет значительно увеличить её общий размер, не выполняя при каждом запросе вычисления со всеми 1,6 трлн параметров. Веса V4 Pro опубликованы по лицензии MIT.
📌 Главная особенность V4 Pro – работа с очень большим контекстом. Модель может одновременно учитывать до 1 млн токенов, поэтому ей можно передавать крупную программную базу, большой комплект документов или длительную историю работы агента. DeepSeek переработала механизм хранения и обработки такого контекста: при его максимальном заполнении V4 Pro требует примерно в четыре раза меньше вычислений и в десять раз меньше памяти, чем предыдущая DeepSeek V3.2.
Это необходимо прежде всего для ИИ-агентов. Вместо подготовки одного ответа модель может изучать структуру программного проекта, читать связанные файлы, пользоваться терминалом и другими инструментами, вносить изменения, проверять результат и продолжать работу после обнаружения ошибки. DeepSeek уже адаптировала V4 для работы с Claude Code, OpenCode и другими агентными средами и использует её во внутренних системах программирования.
🔺 Впервые для DeepSeek новая флагманская модель изначально адаптирована под китайские ИИ-ускорители Huawei Ascend. Предыдущие поколения компании в значительной степени опирались на NVIDIA. V4 стала важной частью перехода китайской ИИ-отрасли на собственную вычислительную инфраструктуру, а Huawei заявила о полной поддержке модели на системах с ускорителями Ascend 950.
При этом DeepSeek продолжает конкурировать не только характеристиками, но и стоимостью работы модели. Сейчас официальный API V4 Pro стоит 0,435 доллара за 1 млн входных и 0,87 доллара за 1 млн выходных токенов. Если отправить модели 1 млн новых токенов и получить столько же в ответе, стоимость составит около 1,3 доллара. У Claude Fable 5 аналогичный объём при базовых тарифах обходится в 60 долларов, то есть примерно в 46 раз дороже.
Причём ценовая политика DeepSeek меняется очень быстро. После запуска V4 Pro компания временно снизила её стоимость на 75%, а 22 мая объявила эту скидку постоянной. Однако уже 6 августа пользователи API получили предупреждение о предстоящем «значительном повышении» цен.
Отдельно показательно развитие младшей V4 Flash. При её обновлении 31 июля DeepSeek вообще не увеличивала размер модели, а только повторно провела заключительный этап обучения. После этого Flash по ряду задач с программными агентами превзошла апрельскую V4 Pro Preview. Поэтому ожидаемая финальная версия V4 Pro, вероятно, будет отличаться от нынешней предварительной модели прежде всего улучшенной подготовкой для длительной автономной работы.
DeepSeek V4 Pro показывает переход компании от модели для ответов на запросы к вычислительной основе для автономных ИИ-агентов. Миллионный контекст позволяет агенту длительное время хранить состояние большой задачи, разреженная архитектура сокращает объём необходимых вычислений, а интеграция с программными инструментами даёт возможность самостоятельно работать с кодовой базой. Одновременно V4 стала для DeepSeek первым крупным шагом к использованию полностью китайской вычислительной инфраструктуры на базе Huawei.
Справочно. DeepSeek V4 Pro – 1,6 трлн параметров, около 49 млрд активных, контекст до 1 млн токенов, максимальный объём одного ответа – до 384 тыс. токенов. Для предварительного обучения семейства V4 использовалось более 32 трлн токенов данных.
More from @sof_news24
  1. Oct 4, 2026⚔️ Еженедельный аналитический обзор (28 сентября–4 октября 2026 г.) 🔻 В рассматриваемый п…
  2. Oct 4, 2026document post
  3. Oct 4, 2026🇪🇺🇩🇪🇵🇱🇱🇹 Основные изменения военно-стратегической обстановки в Европейской зоне (2…
  4. Oct 4, 2026🇱🇹🇩🇪 Литва / Германия: уточнён график развёртывания 45-й бронетанковой бригады Германи…
  5. Oct 4, 2026document post
  6. Oct 4, 2026🇺🇸🇨🇳🇯🇵🇹🇼 Основные изменения военно-стратегической обстановки в ИТР (28 сентября–4…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →