DeepSeek и Huawei строят мир без Nvidia. Вот, что сегодня DeepSeek сделали
#DeepSeek открыли исходный код целого программного стека для чипов Huawei Ascend.
Чтобы понять масштаб, нужно разобраться с одним словом - CUDA - это платформа NVIDIA, на которой написано буквально всё в современном ИИ.
Чтобы уйти с железа NVIDIA на что-то другое, нужно переписать весь код.
И вот DeepSeek сегодня открыли 7 репозиториев на GitHub - новые и обновлённые:
TileLang - язык программирования, альтернатива CUDA. Позволяет писать код один раз и запускать на разном железе
DeepGEMM-Ascend -ядро матричных вычислений. Достигает 99,8% от физического предела чипа
DeepEP-Ascend - библиотека для коммуникации между чипами в больших кластерах
FlashMLA, TileKernels, DeepSelect, DeepJIT - остальные части стека.
Всё под лицензией MIT. Бесплатно. Открыто.
Отношения DeepSeek и Huawei стратегически выверены.
Смотрите, DeepSeek строит дата-центр во Внутренней Монголии на 160 000 чипов Ascend 950. Их модель V4-Flash оптимизирована специально под Huawei, а не под NVIDIA.
А DeepGEMM-Ascend разработан под чип Ascend 950DT от Huawei, созданный совместно с DeepSeek.
Эти 2 компании создают собственную альтернативу экосистеме NVIDIA.
Это означает, что разрыв в эффективности между Ascend и H100, который раньше был главным аргументом в пользу NVIDIA, технически закрыт на уровне софта.
Но у этой истории есть обратная сторона. Разрыв в ПО сокращается публично, а в производстве - нет.
Следующий проблемный вопрос в китайском ИИ-стеке - решение производственных мощностей Huawei, так как чип Ascend производится на SMIC, а не TSMC, и тут возникает потолок масштабирования.
Post #13452
1.88K