Несколько мыслей по DeepSeek v4:
Я в отпуске, полноценно потестить не могу, но по тем тестам что я провел и почитав аналогичные мнения - в кодинге и в агентных кейсах DeepSeek уступает и Kimi 2.6, и GLM 5.1.
Но текущие войны бенчмарков это все-таки больше хайп, т.к. все равно не сейчас, так через полгода-год китайцы будут уровня opus 4.7-gpt 5.4, что уже вполне приемлемо для большинства задач.
Куда важнее вопросы фундаментальной архитектуры, и вот здесь киты как раз "впереди планеты всей" и являются ориентиром для других китайских лаб. Ведь не будь DeepSeek v3, то мы не увидели бы и Kimi, и Glm (по-крайней мере в их текущем виде)
И тут 2 важных момента: переезд на чипы Huawei (=снижение дефицита компьюта и роста цен), а также новая архитектура сжатия KV-Cache в 10 раз. То есть грубо при том же размере RAM можно вместить 10 пользователей вместо одного.
И нет сомнения, что на этой архитектуре мы в недалеком будущем получим еще более крутые открытые модели, которые конечно будут лучше текущего DeepSeek. То есть в краткосрочной перспективе v4 выглядит не так впечатляюще как хотелось бы, но фундаментальный вклад для всех, и в том числе для нас - обычных консьюмеров - гораздо важнее, тк это как минимум удешевит компьют, а то в последнее время видим обратную тенденцию.
DeepSeek кстати уже анонсирует значительное снижения стоимости API во втором полугодии, после запуска новых нод на Хуавеях.
Post #73
551
AB Notes / AI × 1C × [ ... ] PhotoX (formerly Twitter) Jukan (@jukan05) on X Very interesting. DeepSeek added the following comment with V4: “Due to constraints in high-end compute capacity, the current service capacity for Pro is very limited. After the 950 supernodes are launched at scale in the second half of this year, the price…
- 👍 8