[Лучшие публикации за неделю / Разработка]
Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста
#gguf #kv_cache #llamacpp #local_llm #mtp #multi_gpu #opencode #qwen38 #rtx_3060 #speculative_decoding
Читать
Post #47995
2