TGViewer
Человек 2.0 Человек 2.0 @human20 · 1.38K subscribers
Post #183 465
Релиз долгожданного DeepSeek-V4
⠀
Этот релиз ждали долго. DeepSeek-V3 вышел в конце декабря 2024-го, а уже в январе 2025-го компания поверх V3-Base показала DeepSeek-R1 — ту самую думающую модель, после которой рынок заново пересчитал цену AI-гонки. Тогда на фоне шума вокруг DeepSeek Nvidia за одну сессию потеряла почти $600 млрд капитализации. До V4 после этого дошли только сейчас — примерно через год и четыре месяца.
⠀
Теперь DeepSeek открыл веса DeepSeek-V4 и сразу вывел две модели. V4-Pro — 1.6T общих параметров при 49B активных. V4-Flash — 284B общих и 13B активных. Позиционирование такое: качество рядом с верхним сегментом, цена и скорость — ближе к рабочему инструменту на каждый день.
⠀
Самая сильная часть релиза — контекст. Во всех официальных сервисах по умолчанию дают 1M контекста. API совместим и с OpenAI ChatCompletions, и с Anthropic. В интеграции DeepSeek просит почти символический шаг — поменять имя модели на deepseek-v4-pro или deepseek-v4-flash.
⠀
По цене лучше разводить Pro и Flash по разным полкам. V4-Pro на OpenRouter стоит около $1.74 за 1M входных токенов и $3.48 за 1M выходных. Здесь сравнение уместно с Sonnet, Opus и GPT-5.5: Claude Sonnet 4.6 там стоит $3 и $15, Claude Opus 4.7 — $5 и $25, а у OpenAI на странице GPT-5.5 уже стоит ориентир $5 и $30.
⠀
А вот V4-Flash надо мерить об дешёвый быстрый класс. У DeepSeek это около $0.14 за вход и $0.28 за выход. Claude Haiku 4.5 на OpenRouter стоит $1 и $5. GPT-5.4 mini у OpenAI — $0.75 и $4.5. То есть Flash дешевле Haiku примерно на 86% по входу и на 94% по выходу. Против GPT-5.4 mini разница около 81% и 94%. Вот где релиз реально давит рынок: длинные рабочие сессии становятся почти расходником.
⠀
Отдельная ставка — на агентный сценарий. В анонсе прямо названы Claude Code, OpenClaw и OpenCode. Flash при этом продают как более дешёвую и быструю версию с рассуждением, близким к Pro. Для рынка это важнее очередного сравнения в таблице. Сейчас побеждает модель, которая дешевле тянет длинную рабочую сессию, а не просто красиво смотрится на тесте.
⠀
Кстати, deepseek-chat и deepseek-reasoner отключат 24 июля 2026 года. До этого они просто проксируются на V4-Flash в non-thinking и thinking режимах. Значит, миграция всё равно неизбежна, и DeepSeek специально делает её почти безболезненной.
⠀
Если Pro подтверждает уровень на реальной работе, а Flash не сыпется на длинных агентных задачах, open weights снова подвинут рынок. Следующий спор будет уже про темп: как быстро открытые модели начнут забирать прикладную разработку у Claude/GPT.
⠀
📎 DeepSeek announcement • DeepSeek-V3 • DeepSeek-R1 • Nvidia selloff • OpenRouter pricing • OpenAI pricing

Подписывайтесь: @human20
  • ❤ 5
More from @human20
  1. Oct 5, 2026Post #571
  2. Oct 5, 2026Designeer собирает в одном каталоге анимации, компоненты и референсы для сайтов. Мы сделал…
  3. Oct 4, 2026Самое обидное в Telegram — пропустить полезную вещь в чате, на который ты сам подписался.…
  4. Oct 3, 2026Не знаете с чего начать с Hermes? Воспользуйтесь встроенными в него автоматизациями. Сохра…
  5. Oct 2, 2026Gemini 4 Argon: миллион токенов на ответ по стартовой цене Sol Google представила Gemini 4…
  6. Oct 2, 2026POV: вайбкодер, который не даёт полный доступ codex и апрувит каждый запрос агента вручную
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →