TGViewer
Selectel Selectel @selectel · 63.2K subscribers
Post #6893 1.49K
🎓 Два способа запустить Gemma 4 на сервере
Проверяем Ollama и llama.cpp на практике

Ollama берет на себя часть технической рутины и упрощает развертывание LLM. llama.cpp требует больше ручных действий, но дает больше гибкости в работе с моделью.

✏️ Сравнили оба подхода на Gemma 4 26B A4B и сервере с RTX 4090 при одном, двух и четырех параллельных запросах.

Какой способ запуска оказался быстрее, сколько видеопамяти потребовалось и во сколько обходится удобство Ollama — рассказали в новой статье Академии Selectel 👉
  • ❤‍🔥 7
  • ❤ 5
  • 😎 2
More from @selectel
  1. Sep 30, 2026Разобрались, как запускать Gemma 4? Теперь можно подобрать инфраструктуру. Для инференса L…
  2. Sep 29, 2026Объем памяти или количество ядер — на что смотреть при выборе ускорителя 👀 Метрики, оторв…
  3. Sep 28, 2026Уже выбрали ИИ-модель для сборки интерфейсов 👀 Более 300 LLM для разных задач собрали в н…
  4. Sep 28, 2026Собираем интерфейс сайта за час ⏰ С помощью ИИ Между картинкой и реально работающим протот…
  5. Sep 28, 2026Сколько нужно времени, чтобы собрать интерфейс сайта? ❤️ — 60 минут 🔥 — 90 минут 🌚 — Что…
  6. Sep 25, 2026👾💾 Как работать с данными еще эффективнее? Делимся, что вас ждет в заключительном треке…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →