TGViewer
Про100ИТ Про100ИТ @pro100itru · 1.82K subscribers
Post #634 36
📌 Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM

Сайзинг RAM и vCPU для локальной языковой модели начинается с конкретных весов и профиля запросов. Исходные требования self-hosted LLM включают длину входа и ответа, конкурентность, рантайм и схему offload. Расчёт по размеру весов и формуле KV-кэша даёт стартовую конфигурацию, а прогретый тест показывает реальное потребление памяти и точку, где CPU перестаёт помогать.
Сколько RAM нужно квантованной модели?
RAM должна вмещать веса, KV-кэш, рабочие буферы рантайма и запас ОС. Основой служит размер файлов квантованной модели, а число параметров даёт лишь предварительную оценку. Итог подтверждают…

🔗 Источник: habr.com

#sysadmin #server #security #ai

📲 Подписывайся на канал 👉 @PRO100ITru
More from @pro100itru
  1. Oct 10, 2026Генераторы регулярных выражений Генераторы - полезные помощники, ускоряющие работу с регул…
  2. Oct 10, 2026photo post
  3. Oct 10, 2026Post #853
  4. Oct 10, 2026👮‍♂️ XBox DNS (сервис для доступа к ChatGPT, Claude, Gemini, Google Antigravity и другим)…
  5. Oct 10, 2026Post #851
  6. Oct 10, 2026📌 SINVER — веб‑сервис для единого хранилища инфраструктуры и управления DNS Автор преврат…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →