TGViewer
Всеволод Викулин Всеволод Викулин @vikulin_ai · 5.28K subscribers
Post #162 3.3K
Всеобъемлющая статья про инференс LLM

Многие у меня спрашивают, как посчитать GPU и как после этого сохранить рассудок. Потому что насчитали столько, что даже начальник, который очень-очень любит ИИ, не окнет.

Теперь у меня есть для вас решение: прочитать мою статью и начать оптимизировать насчитанное.

Всю статью старался писать максимально простым языком, чтобы было понятно не только хардкорному инженеру. В ней есть:

- Как устроен инференс LLM
- Как оценить, сколько на него нужно GPU
- Какие есть методы оптимизации
- В каких движках это релизовано

Читайте, делитесь с друзьями.

И задавайте вовпросы в комментариях или в личные сообщения @seva_batareika.
vikulin.ai Внедрить LLM и не разориться. Как считать GPU и уменьшать насчитанное Почему инференс LLM упирается в память, а не в мощность карты, как посчитать нужное количество GPU и как уменьшить это число в разы.
  • ❤ 40
  • 🔥 20
  • ❤‍🔥 8
  • 🥰 2
  • 🤩 2
  • 🐳 2
  • 💯 2
More from @vikulin_ai
  1. Sep 21, 2026Кому можно вайбкодить и как это делать Управление AI-агентами очень похоже на управление л…
  2. Sep 16, 2026Кто управляет разработкой AI-проекта Несколько лет назад во время очередного релиза я поня…
  3. Aug 30, 2026Как стать AI-native компанией AI всегда был гонкой инфраструктуры. Если вы хотите крутые A…
  4. Aug 25, 2026Первый обзор научной статьи в этом канале Я не фанат читать свежие статьи. Сам когда-то за…
  5. Aug 18, 2026Вам LLM побыстрее или подешевле? Выберите только одно Почему-то во всех командах, где я ра…
  6. Aug 15, 2026Топ постов Всеволода Викулина (по мнению Всеволода Викулина) За последнее время я написал…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →