TGViewer
Embedded Doka Embedded Doka @embedoka · 3.79K subscribers
Post #1331 4.71K
Embedded Doka В свободное время начал шатать LLM'ки на локальном железе. Кажется еще чуть-чуть и пересекутся две кривые: доступность мощных и предобученных моделей для решения широкого круга задач (локально) и дешевое железо для их запуска. Вот тут писали про использование…
Вдогонку к бенчмарку: классный онлайн-калькулятор, способный ответить на вопрос сколько вешать в граммах сколько точно памяти нужно для запуска того или иного инференса LLM-модели с учётом заданного квантования, KV-кеша, размера батча и много чего еще:

💾 https://llm-system-requirements.streamlit.app/

Очень здорово, что можно оценить размер хотелок заранее для тех, кто планирует локальную эксплуатацию инференса, и потихоньку начать копить на нужный сетап 💰

@embedoka
  • ✍ 10
  • 🔥 4
  • ❤ 2
More from @embedoka
  1. Sep 4, 2026OpenAI представил новую версию GPT-6 Astra, которая помимо всего прочего умеет проектирова…
  2. Aug 25, 2026Winter is coming... ..поэтому самое время выбрать подарок 😃 ..чтобы инферить LLMки "без р…
  3. Jul 24, 2026#пятничное @embedoka
  4. Jul 17, 2026OpenAI Codex Micro keyboard Codex Micro is a programmable macro keypad designed to make in…
  5. Jun 19, 2026А вот интересно: ранжируют ли ИИ-ассистенты пользователей по степени тупости? Эдакий внутр…
  6. Jun 11, 2026Мечтают ли LLM о QFN-корпусах на День Рождения? 🤔 #пятничное @embedoka
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →