⠀
Этот релиз ждали долго. DeepSeek-V3 вышел в конце декабря 2024-го, а уже в январе 2025-го компания поверх V3-Base показала DeepSeek-R1 — ту самую думающую модель, после которой рынок заново пересчитал цену AI-гонки. Тогда на фоне шума вокруг DeepSeek Nvidia за одну сессию потеряла почти $600 млрд капитализации. До V4 после этого дошли только сейчас — примерно через год и четыре месяца.
⠀
Теперь DeepSeek открыл веса DeepSeek-V4 и сразу вывел две модели. V4-Pro — 1.6T общих параметров при 49B активных. V4-Flash — 284B общих и 13B активных. Позиционирование такое: качество рядом с верхним сегментом, цена и скорость — ближе к рабочему инструменту на каждый день.
⠀
Самая сильная часть релиза — контекст. Во всех официальных сервисах по умолчанию дают 1M контекста. API совместим и с OpenAI ChatCompletions, и с Anthropic. В интеграции DeepSeek просит почти символический шаг — поменять имя модели на
deepseek-v4-pro или deepseek-v4-flash.⠀
По цене лучше разводить Pro и Flash по разным полкам. V4-Pro на OpenRouter стоит около $1.74 за 1M входных токенов и $3.48 за 1M выходных. Здесь сравнение уместно с Sonnet, Opus и GPT-5.5: Claude Sonnet 4.6 там стоит $3 и $15, Claude Opus 4.7 — $5 и $25, а у OpenAI на странице GPT-5.5 уже стоит ориентир $5 и $30.
⠀
А вот V4-Flash надо мерить об дешёвый быстрый класс. У DeepSeek это около $0.14 за вход и $0.28 за выход. Claude Haiku 4.5 на OpenRouter стоит $1 и $5. GPT-5.4 mini у OpenAI — $0.75 и $4.5. То есть Flash дешевле Haiku примерно на 86% по входу и на 94% по выходу. Против GPT-5.4 mini разница около 81% и 94%. Вот где релиз реально давит рынок: длинные рабочие сессии становятся почти расходником.
⠀
Отдельная ставка — на агентный сценарий. В анонсе прямо названы Claude Code, OpenClaw и OpenCode. Flash при этом продают как более дешёвую и быструю версию с рассуждением, близким к Pro. Для рынка это важнее очередного сравнения в таблице. Сейчас побеждает модель, которая дешевле тянет длинную рабочую сессию, а не просто красиво смотрится на тесте.
⠀
Кстати,
deepseek-chat и deepseek-reasoner отключат 24 июля 2026 года. До этого они просто проксируются на V4-Flash в non-thinking и thinking режимах. Значит, миграция всё равно неизбежна, и DeepSeek специально делает её почти безболезненной.⠀
Если Pro подтверждает уровень на реальной работе, а Flash не сыпется на длинных агентных задачах, open weights снова подвинут рынок. Следующий спор будет уже про темп: как быстро открытые модели начнут забирать прикладную разработку у Claude/GPT.
⠀
📎 DeepSeek announcement • DeepSeek-V3 • DeepSeek-R1 • Nvidia selloff • OpenRouter pricing • OpenAI pricing
Подписывайтесь: @human20
