TGViewer
Записки IT специалиста Записки IT специалиста @interface31 · 9.01K subscribers
Post #4833 3.1K
Как выбрать LLM под конкретную бизнес-задачу?

Отвечают инженеры YADRO, которые протестировали на своих GPU-серверах пять популярных моделей: от огромной DeepSeek-R1-0528 с 685B параметров до небольшой DeepSeek-R1-Distill-14B. Тесты проводили на трех платформах с 4090 и H100 в условиях, максимально приближенных к реальным бизнес-кейсам.

Из статьи вы также узнаете, зачем уменьшать контекстное окно, запускать инстансы одной и той же LLM на нескольких GPU, а в случае с DeepSeek R1 — использовать gpu_memory_utilization=0.95 в vLLM.

Изучить →

erid: 2W5zFHn3M1J
  • 🤮 6
  • ⚡ 2
  • 👍 2
  • ❤ 1
More from @interface31
  1. Oct 9, 2026Post #6858
  2. Oct 9, 2026Ubuntu 26.10 прекращает поддержку Btrfs, XFS и ZFS для каталога /boot при включённом Secur…
  3. Oct 9, 2026Post #6856
  4. Oct 8, 2026Караван-сарай или величественный собор? Наткнулся я тут случайно на такой проект, как CBSD…
  5. Oct 8, 2026Post #6854
  6. Oct 8, 2026Леса, домены и их хозяева В обсуждении отдельные участники стали высказывать мнение, что у…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →