TGViewer
Neural Networks | Нейронные сети Neural Networks | Нейронные сети @neural · 11.6K subscribers
Post #10382 323
🚨 DeepSeek обучает модель на 2 трлн параметров и планирует следующую на 8 трлн

Для сравнения:

• Kimi K3: 2,8 трлн параметров
• DeepSeek V4 Pro: 1,6 трлн
• новая модель DeepSeek: 2 трлн
• будущая модель: до 8 трлн

Главная ставка компании заключается в переходе на китайские ускорители. DeepSeek ожидает новые обучающие чипы Huawei в IV квартале 2026 года или I квартале 2027 года.

По данным The Information, глава DeepSeek Лян Вэньфэн заявил инвесторам, что обучение на отечественных чипах «должно сработать».

Пока это планы, раскрытые на встрече с инвесторами, а не официальный релиз модели. Но направление понятно: DeepSeek хочет масштабировать модели и одновременно избавиться от зависимости от Nvidia.

https://www.theinformation.com/articles/deepseek-bets-big-huawei-chips-bypass-u-s-export-controls/
More from @neural
  1. Sep 16, 2026Anthropic учит Claude неопираться на собственные принципы и в некоторых случаях возражать…
  2. Sep 14, 2026Код, агенты и чуть-чуть психологии ⚡️ Именно такой стек тем Сбер подготовил для легендарно…
  3. Sep 10, 2026photo post
  4. Sep 9, 2026🚨 «Играют в рулетку с нашими жизнями»: исследователь ушёл из Anthropic из-за гонки ИИ Дже…
  5. Sep 8, 2026🧬 Google представила AlphaGenome Atlas - карту возможных одноточечных изменений ДНК Атлас…
  6. Sep 6, 2026Python и ИИ в 2026 году: как правильно работать с кодом через ChatGPT, Claude, Cursor и AI…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →