🔥 Qwen3.8-27B Uncensored (Cyber/Agentic) теперь доступен в GGUF с калибровкой под реальные агентные задачи
Это не обычная квантизация на случайном английском тексте. Importance Matrix собрана на реальном agentic-coding трафике: tool calls, пути к файлам, shell-команды, JSON, commit hashes и смешанный Chinese/English.
Главное:
- 27B модель в GGUF
- IQ4_XS весит около 15 GiB
- контекст до 262K в протестированной конфигурации
- de-refusal / uncensored версия
- сохранены vision и MTP
- Apache 2.0
- заточена под coding, agents и cybersecurity-сценарии
Авторы отдельно тестировали сохранение точных путей, UUID и commit hashes — критично для агентов, где одна ошибка в символе ломает команду. IQ4_XS при этом оказался всего примерно на 0,42% хуже Q5_K_M по paired perplexity, но заметно компактнее.
Сам GGUF занимает ~15 ГБ, но реальное потребление VRAM зависит от context size, KV cache и offload - полный 262K контекст потребует существенно больше памяти.
https://huggingface.co/cyjin-yl/Qwen3.8-27B-Uncensored-Cyber-agentic-imatrix-GGUF
Post #3015
2.88K

- ❤ 10
- 👍 7
- 🥰 1
- 🥱 1