TGViewer
Математика Дата саентиста Математика Дата саентиста @data_math · 14.3K subscribers
Post #1201 495
🚨 DeepSeek обучает модель на 2 трлн параметров и планирует следующую на 8 трлн

Для сравнения:

• Kimi K3: 2,8 трлн параметров
• DeepSeek V4 Pro: 1,6 трлн
• новая модель DeepSeek: 2 трлн
• будущая модель: до 8 трлн

Главная ставка компании заключается в переходе на китайские ускорители. DeepSeek ожидает новые обучающие чипы Huawei в IV квартале 2026 года или I квартале 2027 года.

По данным The Information, глава DeepSeek Лян Вэньфэн заявил инвесторам, что обучение на отечественных чипах «должно сработать».

Пока это планы, раскрытые на встрече с инвесторами, а не официальный релиз модели. Но направление понятно: DeepSeek хочет масштабировать модели и одновременно избавиться от зависимости от Nvidia.

https://www.theinformation.com/articles/deepseek-bets-big-huawei-chips-bypass-u-s-export-controls/
  • 🔥 6
More from @data_math
  1. Sep 22, 2026Вопрос уже не в том, нужен ли ИИ, а в том, как его внедрять и масштабировать Найдем ответ…
  2. Sep 21, 2026OpenAI близка к решению ещё одной задачи тысячелетия — гипотезы Ходжа, сообщает The Inform…
  3. Sep 20, 2026VisualGenAI — курс по генеративным моделям в компьютерном зрении, который идёт в ногу с пе…
  4. Sep 18, 2026🧠 Одна формула, которая объясняет идею гомоморфизма: φ(a ∗ b) = φ(a) ∘ φ(b) Смысл простой…
  5. Sep 16, 2026📘 Бесплатная книга по выпуклой оптимизации Convex Optimization: Algorithms and Complexity…
  6. Sep 15, 2026photo post
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →