TGViewer
StepOne | Степан Минин StepOne | Степан Минин @steponeit · 3.27K subscribers
Post #591 3.61K
Если вдруг вы задумались об аренде сервера или сборке своего собственного для запуска LLM, то у меня для вас кое-что есть

CPU inference == боль в попе

Даже 8 ядер и 16 гб ОЗУ дадут максимум 15 токенов в секунду, что можно сравнить со скоростью выполнения кода на джаве

А на GPU, ну...
просто смотреть дорого...

Для простого работяги цена ошибки - выкинутый месяц работы

Но какой-то китаец озаботился вопросом и погонял популярные модели на популярном железе
Так что держите мега ценную и мега полезную табличку

https://github.com/XiongjieDai/GPU-Benchmarks-on-LLM-Inference
GitHub GitHub - XiongjieDai/GPU-Benchmarks-on-LLM-Inference: Multiple NVIDIA GPUs or Apple Silicon for Large Language Model Inference? Multiple NVIDIA GPUs or Apple Silicon for Large Language Model Inference? - XiongjieDai/GPU-Benchmarks-on-LLM-Inference
  • 🔥 10
  • ❤ 6
  • 👍 2
  • 😍 2
  • ❤‍🔥 1
More from @steponeit
  1. Sep 25, 2026Рассказал как я добавил в HydraScript объекты и методы без классов и сделал протоколы. Стр…
  2. Sep 22, 2026Post #858
  3. Sep 21, 2026Post #857
  4. Sep 15, 2026Напомню, что у меня есть WireMock.Grpc.Protobuf — расширение для тех, кто пишет компонентн…
  5. Sep 12, 2026StepOne — официальный контрибутор FusionCache 🤙 Между набросами можно ещё и код писать Fu…
  6. Sep 11, 2026Стояк работодателей 2026 🤫 Оказывается, год назад я предсказал выход Астры! И вместе с эт…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →