TGViewer
Вайб-кодинг Вайб-кодинг @vibecoding_tg · 63.4K subscribers
Post #3998 13.8K
DeepSeek выложила в открытый доступ библиотеку, которая ускоряет вычисления на GPU, лежащие в основе ИИ-моделей.

Она называется DeepGEMM.

Библиотека оптимизирует матричные операции, на которых работают большие языковые модели, и позволяет эффективнее использовать NVIDIA Hopper и Blackwell.

Поддерживаются FP8, FP4 и BF16. Есть оптимизации для моделей с архитектурой Mixture-of-Experts, совмещение обмена данными между GPU с вычислениями и компиляция ядер прямо во время выполнения, без отдельной сборки CUDA при установке.

По данным DeepSeek, DeepGEMM на ряде размеров матриц показывает производительность на уровне или выше специализированных библиотек, вручную оптимизированных экспертами.

https://github.com/deepseek-ai/DeepGEMM#interfaces
More from @vibecoding_tg
  1. Oct 2, 2026ChatGPT может создать вам логотип. А теперь ещё и перевести его в вектор. Прямо в чате. Дл…
  2. Oct 2, 2026Газпромбанк ищет решения от научных команд в финтех-акселератор Трек «Финтех.Наука» рассчи…
  3. Oct 2, 2026Post #4001
  4. Oct 2, 2026Понятия не имею, зачем кто-то это сделал, но я очень рад, что это существует:
  5. Oct 2, 2026Вот такие анимации может делать скрытая модель под ником Space Bunny, которая всё ещё бесп…
  6. Oct 2, 2026Небольшой лайфхак: как создавать моушн-графику с Opus 5.5 без подписки на Claude: 1. Зайди…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →