llama.cpp 近期迎来多项重要更新,涵盖缓存迁移、模型支持、多模态及编辑器插件:
- Hugging Face 缓存迁移:使用
-hf 下载的模型现存储至标准 HF 缓存目录,可与其它 HF 工具共享- gpt-oss 模型支持:原生 MXFP4 格式已加入,与 NVIDIA 合作开发
- 多模态能力:
llama-server 现已支持多模态(PR #12898)- 编辑器插件:VS Code 与 Vim/Neovim 推出 FIM 补全插件
GitHub
GitHub
#GitHub #开源
📢 频道:@GitHubTrendingHub
