官方 @ggml_org 发布 llama.cpp v0.4.1:新增 Maple 20B-A1B、Tencent Hy 4、Spark2.5 等架构支持;改进 Kimi-K3 状态回滚、JSON schema、qwen3-coder 复杂类型解析与 MCP/多模态相关修复,并将 ggml 更新至 v0.24.0。发布说明见 GitHub ggml-org/llama.cpp releases/tag/v0.4.1。
核心要点速览 (Key Takeaways)
- ✓官方发布 llama.cpp v0.4.1,支持 Maple 20B-A1B、Tencent Hy 4、Spark2.5。
- ✓改进 qwen3-coder 解析、Kimi-K3 回滚、JSON schema 与多模态/服务端稳定性。
- ✓ggml 升级到 v0.24.0;发布页 ggml-org/llama.cpp v0.4.1。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察