TGViewer
CONTENTRUN КОНТЕНТРАН CONTENTRUN КОНТЕНТРАН @contentrunai · 69 subscribers
Post #95 39
MacBook Pro с 24 ГБ — это уже полноценная локальная AI-станция.

Qwen 3.5-9B при квантизации Q4 выдаёт ~40 токенов в секунду, поддерживает контекст 128K, режим «размышления» и работу с инструментами. Без интернета, без API-ключей, без передачи данных в чужие облака. Всё это помещается в LM Studio рядом с десятком открытых вкладок.

Но есть нюанс: настройка занимает время. Выбор между Ollama, llama.cpp и LM Studio, подбор квантизации, параметры вроде K Cache Quantization Type — это отдельная работа. Модели, которые «технически помещаются» в память (24B, 20B), на практике работают неприемлемо медленно. 9B Q4 — золотая середина.

Локальный AI не заменит SOTA-модели для сложных задач. Но для исследований, планирования и кода в интерактивном режиме — это работает. 👾

Разобрали, как использовать это на практике 👉 Читать на платформе

ИИ Инструменты | Контент-завод | База знаний
  • 🔥 1
More from @contentrunai
  1. Aug 24, 2026Post #185
  2. Aug 10, 2026Открытая модель не отклонила ни одного запроса на хакерские операции. Ни одного. GLM-5.2 о…
  3. Aug 9, 2026Эксперты получают от ChatGPT больше — не потому что умеют «лучше промптить». Математик Тер…
  4. Aug 8, 2026✨ — это больше не «красиво». Это теперь официальный символ ИИ. Каждая эпоха оставляет след…
  5. Aug 8, 2026ChatGPT Work на мобиле и десктопе — это два разных инструмента. Мало кто это знает. Когда…
  6. Aug 7, 2026Claude взломал три реальные компании. Случайно. Аnthropicпровела тест наступательных кибер…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →