🚨 DeepSeek обучает модель на 2 трлн параметров и планирует следующую на 8 трлн
Для сравнения:
• Kimi K3: 2,8 трлн параметров
• DeepSeek V4 Pro: 1,6 трлн
• новая модель DeepSeek: 2 трлн
• будущая модель: до 8 трлн
Главная ставка компании заключается в переходе на китайские ускорители. DeepSeek ожидает новые обучающие чипы Huawei в IV квартале 2026 года или I квартале 2027 года.
По данным The Information, глава DeepSeek Лян Вэньфэн заявил инвесторам, что обучение на отечественных чипах «должно сработать».
Пока это планы, раскрытые на встрече с инвесторами, а не официальный релиз модели. Но направление понятно: DeepSeek хочет масштабировать модели и одновременно избавиться от зависимости от Nvidia.
https://www.theinformation.com/articles/deepseek-bets-big-huawei-chips-bypass-u-s-export-controls/
Post #10382
323

