TGViewer
Python RU Python RU @pro_python_code · 12.4K subscribers
Post #2064 1.76K
На Hugging Face выкатили 18B «франкенштейн»-модель, которая бьёт 35B

Без дообучения. Просто сборка.

Модель на 18B обходит Qwen3.6-35B-A3B в наборе из 44 тестов,
при этом требует всего 12GB VRAM вместо 24GB.

И запускается на обычной RTX 3060.

Что внутри:

- смешанный reasoning от Opus 4.6 и GLM-5.1
- стабильная генерация 66+ токенов в секунду
- нормальная работа с tool calling
- подходит для агентных сценариев

Размер GGUF - около 9.8GB (Q4_K_M),
то есть спокойно помещается на карту с 12GB памяти.

Это не новая архитектура и не прорыв в обучении.
Это грамотная сборка уже существующих моделей.

Но результат интересный.

По сути получился компромисс между лёгкими 9B и тяжёлыми 27B+ моделями.
Достаточно умный, при этом не требовательный к железу.

Если у тебя 12–16GB VRAM — это сейчас один из самых удобных вариантов под локальный запуск.

https://huggingface.co/Jackrong/Qwopus-GLM-18B-Merged-GGUF
  • 👍 7
  • ❤ 1
More from @pro_python_code
  1. Sep 21, 2026Kubernetes NodeLocal DNSCache: ускоряем DNS-запросы 🚀 Без NodeLocal DNSCache DNS-запрос о…
  2. Sep 13, 2026🔥 Один из лучших обучающих курсов на StepiK по SQL SQL можно знать годами и всё равно тер…
  3. Sep 11, 2026⚡️ DeepSeek открыла веса V4.1-Flash DeepSeek выложила свежайшую DeepSeek-V4.1-Flash, мульт…
  4. Sep 11, 2026Команды ждут тебя на треке программирование роботов на МТС True Tech Champ 2026 — всеросси…
  5. Sep 10, 2026⚡️ DeepSeek выпустила V4.1 Flash Ноую модель уже раскатывают в веб-чате и мобильных прилож…
  6. Sep 7, 2026🧠 Как обучить нейросеть на Python с нуля Пошаговый разбор полного процесса: * подготовка…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →