Гонять LLM на российских чипах без танцев с бубном? Baikal выкатил спеки своего ИИ-ускорителя для дата-центров.
BE-AI-D1000 обещает стать ответом на L40S. Ждать, правда, придется до 2029-2030 года:
→ 1000 TFLOPS в fp8 и 500 в fp16
→ 48–64 GB памяти (целятся в GDDR)
→ Прайс в районе $10 000
Главная фишка — софт. Заявлена совместимость с экосистемой CUDA, PyTorch и TensorFlow из коробки (явно не обойдется без трансляторов уровня ZLUDA).
В довесок готовят серверный ПАК: тесная спайка GPGPU и свежего ARM-процессора Baikal S2 (Neoverse N2). То есть собирают свой аналог DGX. Бигтех уже подключился к проектированию, так что пилят не в вакууме.
#AI #LLM #highload #architecture
Post #457
60

- ❤ 2
- 🤡 2